Buzz 离线转写三步教程:本地跑 Whisper,录音直接变文字稿
【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAI's Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz
两小时的会议录音,你不想逐句手打字幕。Buzz 是一台离线语音转写工具,Whisper 模型直接跑在你电脑里,音频不离开本机,生成的文字稿带时间戳,还能顺手导出 SRT 字幕。
主界面:左侧任务队列显示每个文件的转写进度,右侧可直接播放音频对照文稿
安装 Buzz 并下载第一个模型
用 PyPI 渠道最省事(需要 Python 3.12 和 ffmpeg):
pip install buzz-captions python -m buzzLinux 也可以走sudo snap install buzz。想要源码可以git clone https://gitcode.com/GitHub_Trending/buz/buzz,但日常使用不必碰仓库。
首次转写前只有一个前置动作:下模型。打开 Preferences 窗口,切到 Models 标签页,Group 下拉框选 "Faster Whisper"(它是官方 Whisper 的 CTranslate2 重写版,同样的效果跑得更快),在 Available for Download 分组里点中Medium。点 Download,进度条走完模型就出现在 Downloaded 分组;下载中断也没关系,重进再点会续上已缓存的部分。模型缓存在本机的.cache/buzz/models,之后离线语音转写全程不需要网络。
Models 标签页:Group 选模型组,中间是已下载/可下载列表,下方是 Download、Delete、Show file location
把本地录音变成带时间戳的文字稿
File 菜单里点 Import File,选一个 mp3、wav、flac、m4a 都行。弹出的导入窗口里,Model 保持 Faster Whisper,模型大小选 medium(首次用,速度和质量都够用),Language 留 "Detect Language" 让模型自己判断,Task 选 Transcribe。Export 一行勾上 SRT,再勾 TXT,点 OK。
队列里出现一个新任务,进度条慢慢走。完成后点这条任务,Transcription Viewer 打开:左边是带时间戳的文字稿,上方可以播放音频逐句对照,TXT 和 SRT 文件直接落在音频所在目录。
转录结果:段落按时间戳对齐,播放头走到哪一句高亮哪一句
把外语播客翻译成中文
外语内容的关键在 Task 一行。Language 选源语言(或留 Detect),Task 改选 "Translate to English"——Whisper 的翻译方向是输出英文稿,这一步先拿到干净的英文。
想要中文稿:点窗口底部的 Advanced Settings,勾选 "Enable AI translation",在 AI model 一行填一个支持文本生成的 LLM 模型 ID(填本地模型即可,不必外发)。Buzz 会把英文稿逐句喂给模型翻译,字幕的时间戳保持不变。这一步依赖 LLM,其余环节依旧离线。
一整个文件夹批量转写
File 菜单里的 Import Folder 选中一整个文件夹,里面所有音频会逐条进队列,按顺序转。
更进一步,Preferences 的 Folder Watch 标签页可以指定一个监听目录:往里面丢新文件,Buzz 自动开始转写,适合"录音笔每天同步一堆 mp3"的场景。失败的任务会在状态列标出 Failed,点开能看到原因,修好重导就行。
模型档位怎么选,硬件怎么匹配
你的硬件是纯 CPU 或核显 → 选 tiny 到 small(tiny 约 73MB,small 约 460MB),medium 也能跑但明显更慢;有 NVIDIA 显卡且装好 CUDA 版 PyTorch → medium 起步,冲质量就上 large-v3(约 2.9GB)或 large-v3-turbo(约 1.6GB,更快);Apple Silicon 的 Mac → Group 换 Whisper.cpp(官方为 M 系列优化,Faster Whisper 在旧款 Intel Mac 上不可选);内存紧张 → tiny 或 base。
踩坑速查
| 现象 | 一句话解法 |
|---|---|
| 下载卡住或失败 | 取消后重新点 Download,已缓存部分不重下 |
| 转写慢 | 换 small 或 base 档,关掉吃 CPU 的后台程序 |
| 中文识别差 | 升到 medium 或更大档位,确认音频里人声够清晰 |
| 模型文件太占空间 | Models 页面选中后点 Delete 清理 |
| 界面没有 Faster Whisper 选项 | 你是旧款 Intel Mac,Group 改选 Whisper.cpp |
把第一段录音拖进 Buzz,选完模型点 OK,剩下的交给它。
【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAI's Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考