免费编程教程

OpenAI Whisper 语音识别

Whisper 是 OpenAI 的语音识别模型支持多语言。有多个模型尺寸从 tiny 到 large。直接转录音频到文本不需要 LM 后处理。本文用 Python 批量转录音频文件。

19 0 0
2026-07-10
语音搜索

构建针对口语化查询的搜索系统,处理语音识别错误和口语特征,提升语音交互场景下的搜索体验。

16 0 0
2026-06-24
语音识别入门

了解语音信号基础,提取 MFCC 特征并训练基于 CTC 的端到端识别模型。

22 0 0
2026-06-16