Buzz 离线转写三步教程:本地跑 Whisper,录音直接变文字稿
2026/9/10 12:52:03 网站建设 项目流程

Buzz 离线转写三步教程:本地跑 Whisper,录音直接变文字稿

【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAI's Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz

两小时的会议录音,你不想逐句手打字幕。Buzz 是一台离线语音转写工具,Whisper 模型直接跑在你电脑里,音频不离开本机,生成的文字稿带时间戳,还能顺手导出 SRT 字幕。

主界面:左侧任务队列显示每个文件的转写进度,右侧可直接播放音频对照文稿

安装 Buzz 并下载第一个模型

用 PyPI 渠道最省事(需要 Python 3.12 和 ffmpeg):

pip install buzz-captions python -m buzz

Linux 也可以走sudo snap install buzz。想要源码可以git clone https://gitcode.com/GitHub_Trending/buz/buzz,但日常使用不必碰仓库。

首次转写前只有一个前置动作:下模型。打开 Preferences 窗口,切到 Models 标签页,Group 下拉框选 "Faster Whisper"(它是官方 Whisper 的 CTranslate2 重写版,同样的效果跑得更快),在 Available for Download 分组里点中Medium。点 Download,进度条走完模型就出现在 Downloaded 分组;下载中断也没关系,重进再点会续上已缓存的部分。模型缓存在本机的.cache/buzz/models,之后离线语音转写全程不需要网络。

Models 标签页:Group 选模型组,中间是已下载/可下载列表,下方是 Download、Delete、Show file location

把本地录音变成带时间戳的文字稿

File 菜单里点 Import File,选一个 mp3、wav、flac、m4a 都行。弹出的导入窗口里,Model 保持 Faster Whisper,模型大小选 medium(首次用,速度和质量都够用),Language 留 "Detect Language" 让模型自己判断,Task 选 Transcribe。Export 一行勾上 SRT,再勾 TXT,点 OK。

队列里出现一个新任务,进度条慢慢走。完成后点这条任务,Transcription Viewer 打开:左边是带时间戳的文字稿,上方可以播放音频逐句对照,TXT 和 SRT 文件直接落在音频所在目录。

转录结果:段落按时间戳对齐,播放头走到哪一句高亮哪一句

把外语播客翻译成中文

外语内容的关键在 Task 一行。Language 选源语言(或留 Detect),Task 改选 "Translate to English"——Whisper 的翻译方向是输出英文稿,这一步先拿到干净的英文。

想要中文稿:点窗口底部的 Advanced Settings,勾选 "Enable AI translation",在 AI model 一行填一个支持文本生成的 LLM 模型 ID(填本地模型即可,不必外发)。Buzz 会把英文稿逐句喂给模型翻译,字幕的时间戳保持不变。这一步依赖 LLM,其余环节依旧离线。

一整个文件夹批量转写

File 菜单里的 Import Folder 选中一整个文件夹,里面所有音频会逐条进队列,按顺序转。

更进一步,Preferences 的 Folder Watch 标签页可以指定一个监听目录:往里面丢新文件,Buzz 自动开始转写,适合"录音笔每天同步一堆 mp3"的场景。失败的任务会在状态列标出 Failed,点开能看到原因,修好重导就行。

模型档位怎么选,硬件怎么匹配

你的硬件是纯 CPU 或核显 → 选 tiny 到 small(tiny 约 73MB,small 约 460MB),medium 也能跑但明显更慢;有 NVIDIA 显卡且装好 CUDA 版 PyTorch → medium 起步,冲质量就上 large-v3(约 2.9GB)或 large-v3-turbo(约 1.6GB,更快);Apple Silicon 的 Mac → Group 换 Whisper.cpp(官方为 M 系列优化,Faster Whisper 在旧款 Intel Mac 上不可选);内存紧张 → tiny 或 base。

踩坑速查

现象一句话解法
下载卡住或失败取消后重新点 Download,已缓存部分不重下
转写慢换 small 或 base 档,关掉吃 CPU 的后台程序
中文识别差升到 medium 或更大档位,确认音频里人声够清晰
模型文件太占空间Models 页面选中后点 Delete 清理
界面没有 Faster Whisper 选项你是旧款 Intel Mac,Group 改选 Whisper.cpp

把第一段录音拖进 Buzz,选完模型点 OK,剩下的交给它。

【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAI's Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

需要专业的网站建设服务?

联系我们获取免费的网站建设咨询和方案报价,让我们帮助您实现业务目标

立即咨询