TMSpeech:Windows 免费离线语音转文字完整指南,本地识别实时出字幕
2026/8/27 13:17:26 网站建设 项目流程

TMSpeech:Windows 免费离线语音转文字完整指南,本地识别实时出字幕

【免费下载链接】TMSpeech腾讯会议摸鱼工具项目地址: https://gitcode.com/gh_mirrors/tm/TMSpeech

TMSpeech 是一款免费开源的 Windows 离线语音转文字工具。它捕获电脑正在播放的声音,识别全部在本地完成,结果实时显示为字幕,并按日期存成日志文件。适合需要会议纪要、课程笔记、视频补字幕的用户,无需联网,也不用注册账号。

🎬 哪些场景用得上:先判断值不值得装

  • 经常开会:捕获会议软件的内音实时转文字,被点名时翻一下历史记录就能接上话,当天记录稍作整理即成纪要;
  • 看在线课程:讲解内容变成字幕实时跟随,漏听的要点可以事后从历史里回看原文;
  • 给无字幕视频补字幕:把视频声音转成语幕条,窗口拖到播放器下方,不遮挡画面;
  • 练听力:换英文或中英双语模型,边听外语材料边对照字幕校准理解。

首次运行:从解压到出字幕最短 4 步

  1. 获取程序:从 Release 页面下载压缩包并解压,或执行git clone https://gitcode.com/gh_mirrors/tm/TMSpeech拉取源码自行构建;
  2. 双击运行TMSpeech.exe:首次启动会自动生成配置文件与日志目录,不需要手动初始化;
  3. 安装模型:打开设置界面的"资源"页,给中文、英文或双语模型之一点击"安装",等待下载完成(中文模型约 300MB);
  4. 回到主界面点开始按钮:字幕开始滚动,识别结果同步写入日志文件。

配置改乱了不用重装:运行 Release 包自带的重置配置脚本(bat),删除现有配置即可回到出厂默认状态。

音频源、识别器、模型怎么对号入座

选项组选项适用场景建议
音频源系统音频会议、课程、视频等电脑内放的全部声音默认选它,系统静音也能取到内音
音频源麦克风录你本人的说话声口述笔记、语音草稿时切换
音频源进程音频只捕获某个指定应用的声音需要隔离单个程序时用
识别器Sherpa-Onnx普通 CPU 环境默认选它,装好模型即用
模型中文 / 英文 / 中英双语均为 Zipformer-transducer 系列纯中文场景装中文模型即可

对速度和资源占用要求更高时,可在识别器里换 Sherpa-Ncnn,它支持 Vulkan 计算,表现更激进,适合尝鲜。

字幕在哪显示,日志存到哪里

  • 字幕:显示在无边框小窗口中,可任意拖动和缩放;右键可修改字体、字号、颜色、透明度、阴影;
  • 配置:保存在%AppData%\TMSpeech\config.json(JSON 格式),修改后即时更新对应模块,不用重启程序;
  • 日志:识别结果按日期存到"我的文档"下的TMSpeechLogs文件夹;
  • 复制导出:历史记录窗口里右键菜单或按Ctrl-C复制选中内容,方便摘取关键段落。

识别不准、录不到声音:现象与处理

  • 现象:识别准确率不高 → 处理:先排除环境噪声、多人同时说话、音频源选错,都正常就换语言模型,或在设置里手动指向更合适的流式模型路径;
  • 现象:录不到系统声音 → 处理:在"声音控制面板"的"录制"页启用"立体声混音"设备(面板里看不到时,勾选"显示禁用的设备"打开它),再设为音频源;
  • 现象:找不到日志文件 → 处理:确认我的文档\TMSpeechLogs文件夹存在且有写入权限,权限异常时以管理员身份运行;
  • 现象:CPU 占用偏高 → 处理:换更省资源的识别器、改用更小的模型、关闭实时标点等附加处理(作者实测 AMD 5800u 笔记本上默认配置占用低于 5%)。

🔧 想接自己的模型:插件目录与命令行协议

通用能力(插件管理、任务调度、配置管理、资源管理)集中在 src/TMSpeech.Core/,具体功能以独立插件放在 src/Plugins/ 下;程序启动时扫描plugins目录,按各插件的tmmodule.json加载程序集。想新增音频来源、识别引擎或翻译功能,实现IAudioSourceIRecognizerITranslator等接口后放入插件目录即可,核心代码保持不变。

另一条路是设置里的"命令行识别器":它启动一个外部子进程,子进程标准输出作为字幕来源,输出新的一行即刷新当前句子,随后跟一个空行(两个换行)表示该句完成并写入历史;标准错误写入日志文件,双方统一 UTF-8 编码。协议允许模型在出字过程中回头修正前面的内容,最终留存的是稳定句子。注意两点:此模式下子进程自行采集音频,设置里的音频源切换不生效;批处理脚本开头要加@隐藏回显,结尾不要写pause。参考脚本见 external_recognizer/。

写在最后

TMSpeech 的定位很明确:Windows 平台的免费、离线、解压即跑的语音转文字方案,音频不出本机,断网可用。经常开会、要课程笔记、需要给视频批量补字幕的用户,装来试试即可。使用上有任何不顺手之处,或直接开 Issue 提需求;熟悉 Windows/C# 开发也欢迎提交 Pull Request。

【免费下载链接】TMSpeech腾讯会议摸鱼工具项目地址: https://gitcode.com/gh_mirrors/tm/TMSpeech

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

需要专业的网站建设服务?

联系我们获取免费的网站建设咨询和方案报价,让我们帮助您实现业务目标

立即咨询