免费编程教程

OpenAI Whisper 语音识别

Whisper 是 OpenAI 的语音识别模型支持多语言。有多个模型尺寸从 tiny 到 large。直接转录音频到文本不需要 LM 后处理。本文用 Python 批量转录音频文件。

18 0 0
2026-07-10
Whisper 模型使用

学习 OpenAI Whisper 的多任务多语言模型,实现高精度的语音识别、语言检测和多语种语音翻译。

19 0 0
2026-06-19
语音识别 ASR DeepSpeech

使用 Mozilla DeepSpeech 训练端到端的语音识别模型,理解其声学模型、语言模型与集束搜索解码原理。

21 0 0
2026-06-19
语音识别入门

了解语音信号基础,提取 MFCC 特征并训练基于 CTC 的端到端识别模型。

22 0 0
2026-06-16