
Buzz五步完成离线音频转录在本地生成字幕文件【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzzBuzz 是一款基于 OpenAI Whisper一种语音识别模型的离线音频转录工具。它在你的个人电脑上本地运行模型音频文件无需上传转录、翻译几乎 100 种语言。本文带你走完安装、跑通第一次转录、导出字幕的完整流程。一、安装 Buzz不同系统的安装入口不一样macOSbrew install --cask buzzLinuxFlatpakflatpak install flathub io.github.chidiwilliams.Buzz习惯命令行pip install buzz-captions然后用python -m buzz启动Windows 可以直接下载安装包系统弹出安全警告时点更多信息再仍要运行。首次运行选择模型后会自动下载模型文件这一步需要联网之后转录过程就可以离线使用。二、第一次转录从导入到导出 SRT流程不长导入文件、设三个参数、点运行。点击导入媒体文件或按 Ctrl/CmdO。音频、视频都可以视频文件会自动提取音轨选择任务类型转录或翻译并指定语言留空则自动检测选好模型点运行。完成后双击任务行打开转录查看器查看器里点击某一段文字会播放对应音频时间戳对不齐时可以手动拖动片段的起止时间。确认无误后从导出菜单保存为 TXT、SRT 或 VTT其中 SRT 是常见字幕格式可直接导入视频编辑软件。不想开图形界面也可以用 CLI比如用 whisper.cpp 后端转录并直接输出 SRTbuzz add --model-type whispercpp --model-size small --srt 音频文件.mp3三、选对模型与后端精度和速度需要权衡。Buzz 提供多个后端模型尺寸从 tiny 到 large 五档越大越准占的内存也越多后端说明适合场景whisperOpenAI 原版实现默认后端求稳定的基线选择whispercppC 实现支持 Vulkan GPU 加速想用上显卡fasterwhisper转录速度更高的实现批量处理大量音频huggingface加载社区贡献的模型想用某个特定模型openaiapi调用 OpenAI 兼容接口已有 API 账号命令行不指定时默认 whisper tiny。有独立显卡的话medium 及以上模型配 whisper.cpp Vulkan 是常见组合纯 CPU 机器从 base 或 small 起步更稳妥。四、实时录音转录会议Buzz 可以接麦克风边说边转。在实时录音模式里选好麦克风和语言点击录音后文字会陆续出现。默认转录延迟是 20 秒即说完 20 秒后才吐出对应的文字精度和即时性在这里做了折中数值可在设置里调整。Buzz 还支持说话人区分speaker identification能标出每段话是谁说的整理多方发言的会议纪要时有用。五、出了问题怎么办常见情况排查转录慢换更小的模型或改用 whisper.cpp 后端顺手关掉占内存的程序语言识别错手动指定语言比自动检测更可靠术语转错在高级设置里加初始提示initial prompt把专有名词写进去相当于给模型一个上下文操作细节拿不准查 官方 FAQ安装文档 有更完整的说明六、适合谁下一步做什么Buzz 适合本地音频量大、对隐私敏感、或者只想快速出字幕的用户如果你的场景必须走云端接口或要求秒级出结果在线服务可能更合适。符合前者的话今天装好后转一段 5 分钟的录音并导出 SRT看完准确率就能决定长期用哪个模型。【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考