语音#语音识别#字幕#多语言

Whisper · OpenAI 开源语音识别模型

开箱即用的多语言语音转文字,字幕与会议记录的开源基石

109k stars 13k forksPython MIT 最近提交 2026-08-31 在 GitHub 查看源码

快速上手

pip install -U openai-whisper
whisper meeting.mp4 --model small --language zh
# 输出 txt/srt,可直接导入剪辑软件

项目速览

Whisper 是 OpenAI 开源的鲁棒语音识别模型:多语言、抗噪、可转写可翻译,几乎所有开源字幕工具、会议记录、语音笔记产品的底座都是它或其变体(推理加速版 whisper.cpp / faster-whisper 同样出自社区)。

能做什么

  • 音视频文件一键转写,自动时间戳,中文识别稳定
  • 多语种互译到英文,生视频字幕工作流核心
  • 量化版在 CPU/手机上也能实时跑

怎么部署

pip 安装即可用;低配建议 faster-whisper 或 GGML 量化版。结合 会议转写教程 落地到日常办公。

适合谁

做字幕、整理采访/会议、给产品加语音输入的一切用户。

不想部署?试试同类在线工具

返回全部开源项目指标每周自动更新,数据来自 GitHub API