如何用 Buzz + Faster-Whisper 搭好离线转录环境:三步完成你的第一次语音转文字 如何用 Buzz Faster-Whisper 搭好离线转录环境三步完成你的第一次语音转文字【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz两小时的会议录音躺在下载文件夹里在线转写要上传、要排队隐私还说不清。用 Buzz 搭配 Faster-Whisper 做离线转录语音转文字全部跑在你自己的电脑上不上传、不联网、不限时长。30秒看懂读完你能做什么能做什么把你电脑上的会议录音、播客、课程音频转成带时间戳的文字还能顺手翻译成英文需要什么硬件一台普通笔记本即可GPU 可选不必须CPU 四核以上体验就不错花多少时间首次配置约 15~20 分钟大头是模型下载之后每次转写只要两步操作难度新手友好全程 3 条命令 几次界面点击环境准备三步装好 Buzz 离线转写环境第一步拿到代码git clone https://gitcode.com/GitHub_Trending/buz/buzz cd buzz第二步装依赖Buzz 要求 Python 3.12。建一个干净的环境一次性装全python -m venv .venv source .venv/bin/activate # Windows 用 .venv\Scripts\activate pip install -e . # 连同全部依赖一起安装 Buzz第三步确认 faster-whisper 就绪Faster-Whisper 本来就是 Buzz 的核心依赖第二步跑完它就已经装好了验证一下即可pip show faster-whisper # 看到版本号1.x就说明就绪用python main.py启动程序能打开主界面即大功告成。它为什么更快Faster-Whisper 对照表同一套 Whisper 模型权重差别在运行引擎。标准 Whisper 走 PyTorchFaster-Whisper 换到 CTranslate2 上跑并默认开启 int8 量化维度标准 WhisperFaster-Whisper运行后端PyTorchCTranslate2CPU 速度基准约快 2~4 倍内存占用较高int8 量化后明显更低转录精度基准基本持平一句话结论精度几乎不变纯 CPU 场景下速度翻倍还多这正是离线场景的胜负手。Buzz 里这套引擎的实现在 buzz/transcriber/模型下载逻辑在 buzz/model_loader.py想深挖可以顺着看。一次性配置模型首选项里选档并下载打开程序后从菜单进入首选项Preferences切到 Models 标签页引擎选择 Faster-Whisper档位默认 medium 即可点 Download进度条走完就结束磁盘提醒medium 权重约 1.5GBlarge-v3 超过 3GB。文件会放进 Hugging Face 的本地缓存Linux 下是~/.cache/huggingface下载一次、永久本地所以点下载前先看一眼剩余空间。完成第一次转录从导入音频到看结果点主界面左上角的 挑一个 MP3、WAV 或 FLAC 文件设置弹窗里语言选录音实际说的语种不确定就留自动检测任务选 Transcribe想要英文就选 Translate确认后任务进入队列进度条自己会跑跑完双击那行进入播放 逐句对照的查看界面提速清单模型选型速查与并行参数模型档位有点像视频清晰度tiny 最流畅但最模糊large 最清晰但最费劲。原则是先在能流畅跑完的档位里选最高的。模型档位磁盘占用约速度适合场景tiny75MB最快低配机器、快速预览base145MB快日常随手记medium1.5GB中等默认推荐质量速度均衡large-v33GB最慢专业用途、高配机器并行参数方面Buzz 的默认策略是CPU 核心数一半作为推理线程、CPU 上走 int8 量化逻辑见 buzz/transcriber/whisper_file_transcriber.py关键几行供你对照device auto # 自动探测显卡没有则回退 CPU compute_type int8 # int8 量化CPU 更友好 cpu_threads (os.cpu_count() or 8) // 2 # 线程数取核心数一半GPU 是选项不是前提有 NVIDIA 显卡时装好 CUDA 相关依赖后可在高级设置里改用 GPU 计算类型没有显卡可以整段忽略。避坑清单三个常见问题的排查表问题可能原因解决办法模型下载失败或卡住网络到不了模型仓库换网络环境重试或手动把模型文件放进 HF 缓存目录后重启程序转录速度很慢档位偏高、后台程序抢占 CPU降一档medium→base关掉大占用应用有显卡再上 GPU转录准确率低源语言没选对、档位偏低、录音有杂音指定正确源语言换更大模型重录或先降噪下一步用法细节docs/ 里有文件导入、实时录音、翻译等章节想看界面与引擎怎么协作从 buzz/widgets/ 入手模型下载好之后你电脑里的每段录音就都是可转写的了 ️【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考