5分钟跑通Buzz离线音频转文字,转出第一条字幕 5分钟跑通Buzz离线音频转文字转出第一条字幕【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz开完两小时会录音还躺在手机里。丢给在线服务担心内容外泄可字幕又必须做。Buzz 就是干这个的离线转文字工具用 OpenAI 的 Whisper 模型在本机完成识别音频自始至终不离开你的电脑。1. 从下载到第一行文字四步走完按你的系统选安装包Windows 和 macOS 是一键安装程序Linux 用下面这条命令就能装好flatpak install flathub io.github.chidiwilliams.Buzz启动后是主界面中间一张任务表顶部工具栏一排图标按钮。点工具栏上的「New File Transcription」也可以直接把文件拖进窗口选中一段录音会弹出一个设置表单里面挑推理引擎、语言和输出格式。点右下角的「Run」第一次运行时会自动下载模型。稍等片刻主界面表格里出现一行状态先是 Queued接着滚动 In Progress (xx%)。变成 Completed 后双击该行结果窗口弹出——每行文字都带开始、结束时间戳底部是播放条边听边改字。2. 顺手还能干的5件事实时录音转写工具栏「Record」按钮麦克风说的话即时变文字适合会议和讲座。整目录导入File 菜单选「Import Folder...」目录里的媒体文件自动批量进队列按顺序处理。翻译结果窗口点「Translate」整段翻成另一种语言可与原文一并导出。说话人识别「Identify Speakers」按钮自动区分谁在说还能导出带说话人的 DOCX 文档。目录监听偏好窗口里打开 Folder Watch放进指定文件夹的新文件自动转录全程不用手动操作。3. 调顺它也修好这几个常见问题 首次运行卡在下载。第一次点 Run 需要拉模型文件进度框里滚的是下载进度。别急等它走完以后就本地直读、秒开。转录跑得太慢。打开 Help → Preferences...在 Models 页把模型换小一号Small。同样一段音频完成时间能短几倍Large 留给特别含糊的录音。字幕行太长没法用。在结果窗口点「Resize」按钮把「Desired subtitle length」设成 42勾上「Split by punctuation」和「Merge by gap」默认 0.2 秒点「Resize」行宽和断行立即合规。个别格式打不开。Buzz 靠系统的 ffmpeg 解析音频。用 pip 装的版本要先装好 ffmpeg再重新导入文件。4. 原理速览本地推理是怎么跑的Buzz 不自带语音识别它把 Whisper 模型拉到你的机器上做推理断网照样出字。内置多套推理引擎表单里按硬件切换即可各引擎的调用代码都在 buzz/transcriber/ 目录任务与分段数据存在 buzz/db/ 的本地数据库里。各平台的具体安装步骤见 安装说明。5. 你可能想问的问题要联网吗录音会上传吗不会。识别全在本地完成联网只为首次下载模型音频文件不离开这台机器。能用显卡加速吗能。Nvidia 显卡可在 About 对话框里装 CUDA 组件或自己装 CUDA 版 PyTorch。能导出哪些格式Export 菜单里有 SRT、VTT、TXT 等做了说话人识别的话还能额外导出 DOCX。有实时翻译吗没有。翻译发生在转录完成后译文可以和原文一起导出。6. 现在就试 挑一段手机里十分钟的录音丢进去。小模型下几分钟出结果你的机器是什么水平跑完这一次就心里有数了。【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考