免费离线语音转文字:TMSpeech 实时字幕使用指南

📅 发布时间:2026/8/27 12:04:43
免费离线语音转文字:TMSpeech 实时字幕使用指南 免费离线语音转文字TMSpeech 实时字幕使用指南【免费下载链接】TMSpeech腾讯会议摸鱼工具项目地址: https://gitcode.com/gh_mirrors/tm/TMSpeechTMSpeech 是一款在 Windows 上做离线语音转文字的小工具抓取电脑正在播放的声音识别全程在本地完成结果以字幕形式实时上屏同时按日期存成日志文件。不联网、不注册账号解压后就能用。先说它解决什么痛点开会走神、上课漏听、视频没有字幕这些场景的共同点是声音过去了、文字没留下。TMSpeech 的思路把内录的声音实时转成字幕上屏漏掉的内容事后还能从历史记录里翻出来。项目名就来自腾讯会议摸鱼时靠识别记录救场。几个实测数据先给你底识别跑在本地 CPU 上AMD 5800u 笔记本实测占用不到 5%走 WASAPI 环回采集内录系统声音静音也能取到底层是 sherpa-onnx 的 Zipformer-transducer 流式模型中、英、双语都有免安装上手步骤下载 Release 页的最新压缩包解包或执行git clone https://gitcode.com/gh_mirrors/tm/TMSpeech拉源码自行构建双击TMSpeech.exe把它跑起来首次启动会自动生成配置与日志目录在设置里找到资源页给中/英/双语模型之一点安装中文模型约 300MB装完回主界面点开始字幕就出来了。配置改乱了也不用重装Release 包里的重置脚本跑一遍即可回到出厂状态。三组配置按用途挑音频源系统音频抓电脑播放的全部声音默认选它录自己说话换麦克风只想抓某一个程序的声音切到进程音频。识别器Sherpa-Onnx 面向普通 CPU装好模型即用Sherpa-Ncnn 支持 GPU 加速想榨速度再试它命令行识别器留给想接自家模型的人。模型三者都是 Zipformer-transducer 系列纯中文场景装中文模型英文听力或双语材料再换对应语言。改完保存对应模块即时生效不用重启配置是 JSON 格式存放在 %AppData%\TMSpeech 下的 config.json。字幕窗口与日志字幕显示在一个无边框小窗口中可随意拖动、缩放右键能改字体、字号、颜色、透明度和阴影结果按日期落盘在文档目录下的 TMSpeechLogs 里历史记录窗口支持右键复制也可以选中后按 Ctrl-C摘取关键段落很快。遇到问题先看这几条字幕不准先排除环境噪音、多人抢话、音频源选错都没问题就换语言模型或在设置里手动指定其他流式模型。听不到系统声音通常是设备没启用到声音控制面板的录制页打开立体声混音隐藏状态下先勾显示禁用的设备再把它设为音频源。日志不见了确认文档目录下的 TMSpeechLogs 文件夹可写权限有问题就改用管理员身份运行。CPU 有点高换成更省的识别器或更小的模型把实时标点等附加处理关掉。 进阶接一个自己的识别器基础能力插件管理、调度、配置、资源下载都沉在核心层 src/TMSpeech.Core/音频源、识别器、翻译器以插件形式独立在 src/Plugins/ 下程序启动时扫描 plugins 目录按每个插件里的 tmmodule.json 加载程序集。想加新能力实现 IAudioSource、IRecognizer 这类接口丢进插件目录就行核心代码不用动。对普通用户最有用的进阶是命令行识别器TMSpeech 拉起一个外部子进程把它的标准输出当作字幕——每输出一行就刷新当前句子空一行代表这句话定型并写入历史标准错误进日志文件全程 UTF-8。这样设计是允许模型出字中途回头纠错留下的永远是稳定句子。两个注意点这个模式下音频由子进程自己采集设置里的音频源切换不生效批处理脚本开头要加隐藏回显结尾别写pause。参考脚本在 external_recognizer/ 目录里。一句话收尾TMSpeech 的定位很窄但实用Windows 上的免费语音转文字加离线实时字幕音频全程不出本机、断网照常跑、解压即用。常开会、要课程笔记、想给视频批量补字幕装一次就够。【免费下载链接】TMSpeech腾讯会议摸鱼工具项目地址: https://gitcode.com/gh_mirrors/tm/TMSpeech创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考