Buzz离线语音转文字:三步上手本地转录工具

📅 发布时间:2026/9/6 22:34:48
Buzz离线语音转文字:三步上手本地转录工具 Buzz离线语音转文字三步上手本地转录工具【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz你是否遇到过这样的场景一段几十分钟的访谈录音需要当天出文字稿而云端转录服务要么收费、要么让你担心数据外泄Buzz 是一款离线语音转文字工具基于 OpenAI 的 Whisper 模型在你自己的电脑上完成转录、翻译和字幕制作全程不需要联网。一、它到底能帮你做什么你有一段 MP3、WAV 或 MP4 文件要出文字稿导入即可转录也支持直接粘贴在线链接无需先下载视频。你需要边开会边出记录开启麦克风实时录音转录声音一边被识别一边显示为文字。你希望转录结果更干净开启语音分离先降噪提取人声再转录转录后还能识别不同说话人。你要给视频配字幕转录结果可直接导出为 SRT 或 VTT再一键按长度调整字幕分段。二、从下载到第一次跑通安装按你的系统选一种即可macOS从 SourceForge 下载.dmg双击安装Windows从 SourceForge 下载安装包应用未签名安装时若提示安全警告选更多信息 → 仍要运行Linuxflatpak install flathub io.github.chidiwilliams.Buzz或sudo snap install buzz源码方式pip install buzz-captions需 Python 3.12 并自行装好 ffmpeg打开后主界面就是一个任务列表上方是导入按钮和偏好设置入口下方每一行对应一个转录任务显示状态、进度和模型信息。第一次转录按这个顺序走点左上角或按 CtrlO / CmdO导入一个音频文件在新增任务行里选择转录、语言和你想用的模型点运行。状态变为 Completed 后双击该行就打开了转录查看器里面是带时间戳的文字稿、播放器以及导出、翻译、字幕调整按钮。三、关键配置与参数怎么设真正影响结果的参数其实就几个重点看这四项参数影响推荐值模型大小tiny / base / small / medium / large决定速度与准确率的平衡模型越大越慢越准日常用 base 或 small重要录音再上 medium / large语言手动指定比自动检测稳定避免识别成奇怪的文字始终手动选择方言口音重的内容尤其必要导出格式TXT / SRT / VTTTXT 出纯文字稿SRT / VTT 出带时间轴的字幕笔记用 TXT配视频用 SRT 或 VTT初始提示Advanced 里填写把人名、专业术语写进去能显著减少拼写错误涉及专有名词的音频值得填一次另外嘈杂环境下可以在选项里勾选Extract speechBuzz 会先把人声从背景音里分离出来再转录准确率会好一些。四、两个典型工作流给课堂录音出文字稿前置录音文件在本地MP3、WAV、M4A 均可语言以中文或英文为主。导入文件任务选转录语言手动选好模型选 small中文比 base 更稳。如果老师常念专业名词点行内的 Advanced... 把术语写进初始提示。点运行完成后双击任务行打开转录查看器边播放边核对。发现错字直接在表格里改时间戳偏了可用快捷键 Ctrl← / Ctrl→ 按 0.5 秒微调。点导出按钮选 TXT得到可直接粘贴进笔记软件的纯文字稿。给播客生成 SRT 字幕前置有干净的播客音频或视频文件知道说话语言。导入文件选择语言勾选Word-Level Timings词级时间戳。运行并打开转录查看器点顶部的调整字幕Resize按钮。在调整对话框里设置每条字幕的理想长度上限Buzz 会把逐词结果合并成阅读节奏合适的字幕段。播放听一遍个别分段不对的段落手动拖一下边界。导出选 SRT字幕文件即可直接拖进视频剪辑软件使用。五、性能、选型与常见卡点模型大小的直观参考模型体积表现tiny约 75 MB最快先用来验证环境是否跑通base约 142 MB速度和准确率的日常平衡点small约 466 MB中文等语言的更稳选择medium / large约 1.5 GB / 2.9 GB重要录音才值得上速度明显变慢新手最容易卡住的三个点显存或内存不够跑大模型换 Whisper.cpp 后端并选量化版本如 q5或在偏好设置里开Reduce GPU RAM压缩显存占用。语言没选导致识别出乱码自动检测并非总是对的养成手动指定语言的习惯比换大模型更见效。Windows 安装时弹出安全警告应用未签名属正常现象更多信息 → 仍要运行即可。有 NVIDIA 显卡时 Buzz 会自动启用 CUDA 加速转录速度可达 3~5 倍老显卡反而更慢时可以设置环境变量BUZZ_FORCE_CPUtrue强制走 CPU。六、延伸入口熟悉图形界面后可以用命令行做批处理最小示例buzz add --task transcribe --language zh --model-size small --srt audio.mp3CLI 完整参数 还支持翻译任务、词级时间戳、同时导出 SRT / VTT / TXT。日常场景里偏好设置中的 Folder Watch 可以监控一个文件夹新放进来的音频自动排队转录配合上面的命令行适合做成固定流程。想系统了解各功能见官方文档。七、上手指引☑ 用 tiny 模型转录一段 30 秒音频确认环境能跑通全流程☑ 打开偏好设置的模型页下载 base 和 small 两个模型备用☑ 手动指定语言再跑一次对比不指定语言的结果差异☑ 用 Word-Level Timings 加字幕调整给一小段音频导出 SRT☑ 用buzz add命令行转录一个文件验证批处理路径可用【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考