
5分钟跑通离线语音转文字whisper.cpp 本地部署与实战指南【免费下载链接】whisper.cppPort of OpenAIs Whisper model in C/C项目地址: https://gitcode.com/GitHub_Trending/wh/whisper.cppwhisper.cpp 是 OpenAI Whisper 语音识别模型的 C/C 实现特点是纯本地运行、无依赖你的录音不需要上传到任何服务器转出的文字也不会离开这台电脑。全文命令都可以直接复制跟着做完你手里会多出一个能批量处理录音的命令行工具。最短路径三条命令出结果先拉取源码git clone https://gitcode.com/GitHub_Trending/wh/whisper.cpp cd whisper.cpp接下来下载 base.en 模型约142MB专为英语优化的入门档位。仓库自带的下载脚本会把它放进models/目录sh ./models/download-ggml-model.sh base.en # 下载 base.en 模型最后一步同时完成编译和首次转写samples/里自带一段 JFK 演讲的示例音频跑完你能立刻看到识别出的英文文本cmake -B build cmake --build build --config Release # 编译项目 ./build/bin/whisper-cli -f samples/jfk.wav -otxt -of jfk # 转写示例音频并输出文本✅ 看到jfk.txt文件生成说明整条链路已经跑通了。模型怎么选不踩坑Whisper 模型有从微型到大型的几档本质是准不准和跑得快不快的权衡。.en后缀表示只对英语做了优化识别英文时更快更准识别中文、日语等多语言就用不带后缀的版本。模型大小内存占用适合场景tiny75 MiB~273 MB实时场景、旧设备base142 MiB~388 MB日常录音新手首选small466 MiB~852 MB会议、播客转写medium1.5 GiB~2.1 GB追求高准确率large-v32.9 GiB~3.9 GB专业级转录 内存紧张时别硬扛whisper.cpp 支持把模型做整数量化压缩一条命令就能生成体积更小、显存占用更低的版本./build/bin/quantize models/ggml-base.en.bin models/ggml-base.en-q5_0.bin q5_0 # 生成 Q5_0 量化模型之后用-m models/ggml-base.en-q5_0.bin指定量化文件运行即可用法和原始模型完全一致。常用参数速查参数默认作用-mbase.en 模型指定模型文件路径-f无输入 WAV 文件-len语言auto为自动检测-otxt/-osrt/-ovtt关输出 txt / SRT 字幕 / VTT 字幕-of音频同名输出文件路径不含扩展名-t4计算线程数-nt关打印结果不带时间戳--prompt空提供上下文提示词场景实战从录音到可用成品场景一会议录音转字幕。你手上有一段录音想做成带字幕的视频那么直接让它输出 SRT 字幕文件剪映、Premiere 都能直接导入./build/bin/whisper-cli -f meeting.wav \ -m models/ggml-small.en.bin \ -osrt -of meeting # 输出 meeting.srt 字幕文件场景二多语言材料自动识别。一段不知道什么语言的播客加-l auto让它自己判断语言再用--prompt塞一点背景信息人名、节目名专有名词的识别准确率会明显提升./build/bin/whisper-cli -f podcast.wav \ -m models/ggml-medium.bin \ -l auto --prompt 这是一档科技播客嘉宾是张明 \ -otxt -of podcast # 自动检测语言并输出文本你还会遇到的几个现象现象把 MP3 丢进去提示无法解析。原因whisper-cli 只吃 16-bit WAV 文件。解决用 ffmpeg 转一下格式ffmpeg -i input.mp3 -ar 16000 -ac 1 -c:a pcm_s16le output.wav # 转为16kHz单声道WAV现象不写-m也能跑但结果和你预期的模型不符。原因没指定模型时它会回退到默认的ggml-base.en.bin。解决养成每条命令都显式写-m的习惯。现象两小时长录音跑到一半内存吃紧。原因默认一次性把整段音频压进内存处理。解决用-ot 600000单位毫秒从第10分钟接着转分段处理即可另外把-t设为物理核心数的一半左右通常比拉满更稳。收尾整套流程跑完后从录音到文字完全发生在你的机器里——不上传、不联网、不泄露这大概就是本地部署最有价值的一句话。模型下载脚本models/download-ggml-model.sh示例音频samples/CLI 完整参数examples/cli/模型格式说明models/README.md语言绑定Java/Go 等bindings/【免费下载链接】whisper.cppPort of OpenAIs Whisper model in C/C项目地址: https://gitcode.com/GitHub_Trending/wh/whisper.cpp创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考