语音#语音识别#字幕#多语言
Whisper · OpenAI 开源语音识别模型
开箱即用的多语言语音转文字,字幕与会议记录的开源基石
快速上手
pip install -U openai-whisper
whisper meeting.mp4 --model small --language zh
# 输出 txt/srt,可直接导入剪辑软件项目速览
Whisper 是 OpenAI 开源的鲁棒语音识别模型:多语言、抗噪、可转写可翻译,几乎所有开源字幕工具、会议记录、语音笔记产品的底座都是它或其变体(推理加速版 whisper.cpp / faster-whisper 同样出自社区)。
能做什么
- 音视频文件一键转写,自动时间戳,中文识别稳定
- 多语种互译到英文,生视频字幕工作流核心
- 量化版在 CPU/手机上也能实时跑
怎么部署
pip 安装即可用;低配建议 faster-whisper 或 GGML 量化版。结合 会议转写教程 落地到日常办公。
适合谁
做字幕、整理采访/会议、给产品加语音输入的一切用户。
返回全部开源项目指标每周自动更新,数据来自 GitHub API