Buzz 离线语音转录工具:从安装到导出字幕的实操指南 Buzz 离线语音转录工具从安装到导出字幕的实操指南【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz会议一结束把录音文件拖进 Buzz几分钟后你就拿到一份带时间戳的文字稿。Buzz 是一款基于 OpenAI Whisper 的离线语音转录工具转录与翻译全部在你的电脑上完成音频不经过任何云端服务。项目速览先说结论Buzz 是一个成熟的桌面应用不是玩具脚本适合长期当作日常工具使用。关键事实如下项目内容开发者Chidi Williams开源项目许可证MIT实现语言Python要求 3.12PyQt6 图形界面底层引擎OpenAI Whisper另提供 Faster Whisper、Whisper.cpp、Hugging Face Transformers 多种后端支持平台Windows、macOSIntel 与 Apple Silicon、Linux导出格式TXT、SRT、VTT查看器中还提供 JSON 等更多格式当前版本为 1.4.5界面内置简体中文、繁体中文等十余种语言包。适合谁不适合谁Buzz 的定位很明确把语音转文字这件事留在本地。适合你如果你处理会议录音、采访素材等敏感音频不想上传到任何云端服务做视频内容需要批量产出 SRT 或 VTT 字幕文件希望自动化文件夹监视、命令行接口都能帮你省去手动操作不适合你如果你的电脑较老Buzz 依赖的推理库要求 CPU 支持 AVX2 指令集更老的机器直接跑不起来你不想先下载模型文件Buzz 离线工作的前提是本地有 Whisper 模型首次使用需要从网络下载模型缓存默认在系统用户目录下你追求开箱即传的实时性实时录音的追加并校正模式会反复重算对硬件有要求性能一般的机器建议用更小的模型从安装到第一次运行最短路径装一个安装包下载一个模型导入一个文件。三个平台各有一个动作。macOS从官方发布页下载.dmg拖入应用程序文件夹即可Apple Silicon 与 Intel 都有对应版本。Windows从官方发布页下载安装包运行。程序未做数字签名安装时系统会弹出安全警告选择更多信息再点仍要运行即可。Linux通过 Flatpak 或 Snap 安装一条命令的事flatpak install flathub io.github.chidiwilliams.Buzz开发者路线在 Python 3.12 环境里执行pip install buzz-captions然后用python -m buzz启动另外需要系统里装好 ffmpeg。pip install buzz-captions首次启动后先到 帮助 → 偏好设置 → 模型 中按需下载模型。模型大小从 tiny 到 large 共五档越小越快、越小越不准首次使用建议选 tiny 或 base 试水。走一遍典型任务以导入一段会议录音导出 SRT 字幕为例完整流程是四步。第一步通过 文件菜单的导入媒体文件快捷键 Ctrl/Cmd O或工具栏按钮选择一个音频或视频文件。Buzz 会用 ffmpeg 自动提取视频中的音轨MP4、MKV 都能直接导入。第二步配置任务参数任务是转录还是翻译成英语语言强烈建议手动指定自动检测基于音频开头几秒判断结果可能出乎意料再选模型后端和大小。第三步点运行。任务会出现在主界面的任务列表里状态变为 Completed 即结束。第四步双击该行打开转录查看器。这里可以搜索文本、按 0.5 秒为单位微调每个片段的起止时间、直接编辑文字最后从导出菜单选择 TXT、SRT 或 VTT。除此之外Buzz 还支持导入 YouTube 链接、对转录结果做机器翻译这里就不展开了。进阶能力选讲三个值得了解的功能实时录音、说话人识别、自动化的组合拳。麦克风实时录音转录选好语言、模型和麦克风后点录音文字边说边出适合做现场记录。三种模式可选新句子追加到下方、追加到上方或追加并校正会尝试修正上一句的错漏最准也最吃性能。开始录音后还会出现演示窗口选项可以把实时字幕投到大屏上演讲和活动场景很实用。注意实时转录建议选 Whisper.cpp 后端加小模型集显甚至纯 CPU 也能跑。说话人识别多人对话的转录结果里点开转录查看器后点识别说话人Buzz 会自动给每句话标注发言人标签。你可以试听某位说话人 10 秒的音频来确认并把自动标签改成真实姓名保存时还能勾选将同一人的连续句子合并成一段。注意该功能在 Intel 版 macOS 上不可用。文件夹监视与自动化在偏好设置里配置一个监视文件夹后新放入的音频文件会自动开始转录适合录音设备落盘 Buzz 出稿的固定工作流。更进一步命令行接口buzz add支持指定模型、语言并直接输出 SRT/VTT/TXT配合插件系统内置 AI 摘要、字幕长度自动调整等插件可以搭出完整的离线流水线。避坑清单以下是官方 FAQ 和文档里高频出现的问题按现象 → 处理整理现象处理转录速度太慢换更小的模型或改用 Whisper.cpp 后端NVIDIA 显卡显存 6GB 以上可上 Faster WhisperWindows 安装时弹出安全警告程序未签名所致属正常现象选更多信息→仍要运行启动或转录时崩溃多半是模型下载不完整到 帮助 → 偏好设置 → 模型 删除后重新下载录音时报麦克风错误PaErrorCode-9999检查系统麦克风权限暂时关闭杀毒软件再试自动检测语言结果不对不要依赖自动检测手动指定语言准确率提升明显老电脑完全无法运行Buzz 需要 CPU 支持 AVX2 指令集更老的硬件不受支持相关资料仓库内的文档和关键源码目录相对路径如下安装说明含 PyPI 的系统依赖docs/docs/installation.md命令行用法与参数docs/docs/cli.md常见问题docs/docs/faq.md各转录后端实现buzz/transcriber/插件系统与示例插件buzz/plugins/Buzz 把模型、引擎和界面都放在你自己这台机器上隐私边界由你自己掌控。现在就可以去下载对应系统的安装包拿一段短录音把上面的四步流程完整走一遍。【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考