OpenAI Whisper 语音识别
Whisper 是 OpenAI 的语音识别模型支持多语言。有多个模型尺寸从 tiny 到 large。直接转录音频到文本不需要 LM 后处理。本文用 Python 批量转录音频文件。
18
0
0
2026-07-10
Whisper 模型使用
学习 OpenAI Whisper 的多任务多语言模型,实现高精度的语音识别、语言检测和多语种语音翻译。
19
0
0
2026-06-19
语音识别 ASR DeepSpeech
使用 Mozilla DeepSpeech 训练端到端的语音识别模型,理解其声学模型、语言模型与集束搜索解码原理。
21
0
0
2026-06-19