
Buzz 离线音频转录工具如何在本地免费完成语音转文字的完整指南【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzzBuzz 是一款运行在你自己电脑上的离线音频转录工具基于 OpenAI 的 Whisper 模型把会议录音、播客、视频音频转成文字并支持翻译成 90 多种语言。全程不上传任何数据一次配置后完全免费。适合经常整理录音、需要处理敏感音频、又不想依赖在线服务的用户。为什么值得关注在线转录服务要你把音频传到云端敏感内容过第三方服务器按用量收费断网不可用。Buzz 的做法很直接Whisper 模型下载一次之后转录、翻译、导出全部在本地完成录音文件从头到尾不离开你的设备。对新手来说它也是零门槛的图形界面点两下就能开始转录不需要写代码而对进阶用户它又提供了 CLI、文件夹监控和插件系统可以搭自动化流程。对比维度在线转录服务Buzz 本地方案数据去向上传云端留在本地设备网络要求必须联网下载模型后可离线费用按量/订阅收费免费开源语言支持视服务而定90 种语言自动化依赖其 APICLI 监控文件夹10 分钟上手安装 Buzz 并跑通第一次转录Buzz 支持 macOS、Windows 和 Linux三种装法任选一种即可。方式一直接装图形界面推荐新手macOS下载官方.dmg安装包打开后拖入 Applications。Windows下载安装包运行应用未签名弹窗时选「更多信息 → 仍要运行」。Linuxsudo snap install buzz方式二Python 环境安装适合已有开发环境的人先装好 ffmpeg转录依赖它解析音频。使用 Python 3.12 环境执行pip install buzz-captions python -m buzz第一次转录启动后点左上角「」导入一个 mp3/mp4 文件或直接粘贴 YouTube 链接。在任务行里选好模型日常用 base 即可点 Run。等状态变成 Completed双击该行打开转录结果就能边听音频边校对文字。核心能力一览按你能用到的价值来说本地转录与翻译Whisper 在本地跑音频转文字、再翻译成目标语言数据不出电脑。实时录音转录接上麦克风边说边出文字适合会议纪要另有专门的演示窗口开会时投屏展示很方便见 recording_transcriber.py。说话人识别多人对话自动区分不同说话者整理采访录音时很实用见 speaker_identification_widget.py。多后端硬件加速NVIDIA 显卡走 CUDAMac 走 Apple Silicon普通显卡可走 Vulkan速度取决于你的硬件。字幕精修工具按标点、间隔自动重新分段把转录稿整理成合规字幕见 transcription_resizer_widget.py。文件夹监控指定一个文件夹新放进去的音频自动开始转录适合批量处理。插件系统内置 AI 摘要、深度降噪等插件按需启用即可扩展能力见 plugins/。CLI 接口可以用命令行脚本化批量转录方便接入自己的自动化流程文档见 cli.md。选对配置不踩坑模型与硬件怎么搭配选模型的核心逻辑是机器内存够不够音频质量好不好。宁可先用小模型快速出稿再按需换大模型精修也不建议上来就跑 large 然后把电脑卡死。你的情况推荐模型说明8GB 内存 / 核显本tiny 或 base出稿快适合先过一遍内容16GB 内存 / 独显small 或 medium日常会议、播客的主力档位大内存 GPU 加速medium 或 large长音频、专业交付、翻译场景几条能少踩坑的习惯语言尽量手动指定自动检测偶尔会判错尤其对方言或混合语言音频。专有名词多的场景人名、产品名在「高级选项」里填一句包含这些词的 Initial prompt能明显减少错别字。嘈杂环境录音开启「语音提取」或降噪插件准确率提升比较明显。模型下载失败时检查网络代理设置或手动把模型放进缓存目录首选项里可以看到缓存路径。实战场景走一遍场景一会议录音 → 纪要文档导入会议录音文件模型选 medium语言选中文。转录完成后打开结果页边播放边修正人名和公司名。需要精简的话启用 AI 摘要插件生成要点。导出为 TXT 归档文件名可在首选项里用模板自定义。场景二视频 → 平台可用字幕导入 mp4 视频导出格式选 SRT。转录完成后进入字幕调整界面按标点自动分段。把单行长度控制在 42–50 字符左右检查合并间隔是否顺口。导出 SRT/VTT直接上传到视频平台。场景三外语音频 → 中文文稿导入外语音频模型选 small 以上保证翻译质量。任务类型选「翻译」目标语言选中文。本地先出译文个别术语不对就在查看界面手动改。导出 TXT 或带时间轴的 SRT 双语对照稿。遇到问题先查这里现象可能原因解决办法启动报错、提示缺依赖没装 ffmpeg 或系统运行库先安装 ffmpegWindows 补装 VC 运行库模型一直下载失败网络/代理问题换网络环境或手动下载模型放到缓存目录转录明显变慢模型太大、内存不足换更小模型关掉占内存的后台应用识别准确率不高音质差或模型太小开语音提取/降噪或换大一号模型GPU 没生效驱动或 torch 版本不对更新显卡驱动按官方说明重装对应 CUDA 版 torch完整排错内容可查 faq.md首选项各字段含义见 preferences.md。写在最后Buzz 适合三类人手里有大量录音要整理的职场人、需要给视频配字幕的创作者以及处理敏感音频、数据绝对不能出本地的用户。它免费、开源、开箱即用从安装到第一份转录稿通常半小时内就能走完。打开它导入一个音频试试比看十篇介绍都直观。【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考