
Buzz 离线音频转文字完整指南如何在本地完成 Whisper 转录与字幕制作【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzzBuzz 是一款在本机完成离线音频转文字的桌面应用基于 OpenAI 的开源模型 Whisper把音频、视频文件或麦克风录音转成带时间戳的文字还能把内容翻译成其他语言。如果你要整理会议录音、给视频加字幕或把讲座转成文稿又不想把文件上传到云端它就是为你准备的工具。一分钟看懂Buzz 把 Whisper 语音识别包成了图形界面你选文件、选模型它在本地跑完识别并输出带时间轴的文本全程不联网音频不出你的电脑。与只返回纯文本的在线转写服务不同Buzz 提供多套 Whisper 后端原版 Whisper、Faster Whisper、Whisper.cpp、HuggingFace 模型内置带播放控制的转录查看器并支持导出 TXT、SRT、VTT 三种格式。从安装到第一次成功按系统选择安装方式macOS 下载.dmg双击安装Windows 运行安装包应用未做签名弹出警告时选择「更多信息 → 仍要运行」Linux 用下面任意一条命令flatpak install flathub io.github.chidiwilliams.Buzzsudo snap install buzz习惯 Python 的话先装好 ffmpeg 并使用 Python 3.12再执行pip install buzz-captions然后用python -m buzz启动。启动后点 File 菜单的 Import Media File 或工具栏「」按钮快捷键 Ctrl/Cmd O导入文件接着选择任务Transcribe 转写或 Translate to English 翻译成英文、语言和模型点 Run。状态变为 Completed 后双击该行就能看到带时间戳的转录文本。主界面可批量添加音频文件排队处理每行显示转录状态把常用功能用出价值导入音视频并导出字幕文件场景一段访谈录音或课程视频需要转成字幕文件。导入时把 Export As 设为 SRT 或 VTT 即可直接产出字幕勾选 Word-Level Timings 会生成词级时间戳方便之后精确合并字幕行。内容里如果有容易被听错的专有名词在 Advanced... 的 Initial prompt 里写上这些词能明显减少拼写错误。勾选 Extract speech 会先把人声从音频中分离出来再转写适合背景嘈杂的录音。转录查看器可搜索、调节播放速度边听边改文字麦克风实时转写与演示窗口场景会议记录、讲座现场字幕。选好任务、语言、模型和麦克风点 Record 就开始边录边转。注意默认 Whisper 后端对硬件消耗大实时场景建议选 Whisper.cpp 并控制模型不要过大。录制中还可以打开演示窗口把实时字幕投到大屏上。Buzz 也支持录制系统内播放的声音macOS 用 BlackHole 虚拟设备Windows 用 VB CABLE把它选为麦克风即可。合并与拆分字幕行场景转出来的字幕行太碎或太长不适合上屏。打开转录点 Resize当初开了词级时间戳的文本可以设置字幕最大长度并让 Buzz 按标点自动断句还会分析音频里的静音来对齐没开词级时间戳的文本只能按最大长度重新合并。它还能把每行结束时间统一延长指定秒数让字幕停留更久且不会盖到下一行的开始。Resize 选项控制字幕最大长度与断句规则容易踩的坑转写速度很慢——原因通常是模型选得太大或后端不匹配硬件。解决办法先减小模型档位有 6GB 以上显存的 NVIDIA 显卡用 Faster Whisper其他显卡或纯 CPU 环境用 Whisper.cpp它在集显和 CPU 上也能跑实时转写。模型设置页按需下载、删除不同尺寸的 Whisper 模型语言识别错、文本串味——「Detect Language」只根据开头几秒猜测语言。知道内容语言时请手动指定多数情况下准确性会提升。Windows 安装时弹安全警告——应用未签名属正常现象。选「更多信息 → 仍要运行」即可不必额外处理。下载模型后应用崩溃或行为异常——多为模型文件没下完整。到Help - Preferences - Models删除该模型重新下载另外 CPU 需要支持 AVX2过老的机器无法运行。想在完全断网的机器上用 Buzz——Buzz 本体可以离线但模型要先拿到。在有网机器上下载好模型再把模型文件夹拷到离线机器的同一位置Linux 是~/.cache/BuzzmacOS 是~/Library/Caches/BuzzWindows 是%USERPROFILE%\AppData\Local\Buzz\Buzz\Cache仓库里的 scripts/download-models.py 可以帮你提前准备离线模型缓存。继续深入各转写后端Whisper、Whisper.cpp、Faster Whisper、OpenAI API的实现buzz/transcriber/全部界面组件包括转录查看器与偏好设置对话框buzz/widgets/插件系统与 AI 摘要、DOCX 导出等现成插件buzz/plugins/官方文档导入文件、实时录音、翻译、设置、FAQ、命令行docs/docs/Buzz 适合希望把音频转文字全程留在自己电脑上、并且需要自己掌控编辑与字幕格式的场景对模型选择、离线部署和 GPU 加速有更多疑问时直接查 docs/docs/faq.md 与 docs/docs/preferences.md。【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考