
本地免费语音转文字工具 Buzz 完整指南离线转录、翻译与字幕制作【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz上周帮朋友整理一场两小时的访谈录音听一句敲一行差点崩溃。后来我换上了Buzz——一款基于 OpenAI Whisper 的免费离线语音转文字工具把音频、视频丢进去数据不出本机就能拿到文字稿、翻译和字幕。这篇文章带你从安装一路玩到进阶摸清这个桌面神器。Buzz 把 Whisper 强大的转录能力装进了一个人人能上手的桌面程序一、为什么要把听写这件事留在自己电脑上很多人已经习惯了把录音丢给网页版工具几分钟后取结果。这种做法省事但有两个隐患一是敏感内容经过他人服务器会议纪要、客户访谈、未公开的选题都有可能被留存二是好用的云端服务几乎都要订阅按分钟计费量一大就肉疼。Buzz 的思路很直接把转录引擎搬到你的电脑里。音频全程在本地处理不联网也能跑相当于在自家书房请了一位随叫随到的速记员。它还顺带解决了格式碎片化的问题——MP3、WAV 这类纯音频MP4、AVI 这类带画面的视频甚至一段 YouTube 链接都能丢给它处理省去了来回转码的折腾。二、第一次转录从安装到出稿的完整路径Buzz 对主流桌面平台都有对应的安装方式Windows下载安装包后双击运行由于程序未做签名系统弹警告时选更多信息 → 仍要运行即可。macOS下载 DMG 镜像把图标拖进 Applications 文件夹。Linux可通过flatpak install flathub io.github.chidiwilliams.Buzz或snap install buzz安装。Python 环境pip install buzz-captions后用python -m buzz启动。首次启动时会下载你选择的模型文件这部分体积从几十 MB 到几个 GB 不等取决于模型档位。装好后打开主界面点击添加文件、挑一个模型、按下运行任务就进入了处理队列。任务表格里可以清晰看到每个文件的排队、进行中与已完成状态任务队列是 Buzz 的调度中枢你可以一口气塞进十几个文件它们会按顺序处理处理过程中就算把主窗口关掉后台任务依然会跑完回头再打开就能看到成果这点对批量整理录音的人非常友好。三、模型怎么挑速度与精度的选择题Whisper 提供了五档模型Buzz 里全部可选对应关系大致如下模型体积适合场景tiny最小实时转写图快不图精base较小日常语音速度与准确率的平衡点small中等较清晰的讲话内容准确率明显提升medium较大重要会议、访谈追求高准确率large最大字幕制作、出版级需求精度天花板如果电脑配置允许建议先试 small 起步出稿错字偏多再往上跳一档。Buzz 还支持多种后端NVIDIA 显卡可开启 CUDA 加速苹果 M 系列芯片走 Apple Silicon 原生路径Whisper.cpp 后端则支持 Vulkan连核显都能参与计算。这意味着即使没有独显转录速度也能比纯 CPU 快上一截。在偏好设置里切换后端、模型档位与硬件加速选项找到最适合自己机器的组合四、出稿之后时间轴、校对与导出转录完成不是终点Buzz 的查看器才是真正花心思的地方。每一句字幕都带精确的开始和结束时间底部有播放器可以边听边核对发现识别错误直接在表格里改字即可改动会自动保存。播放速度可调配合关键词搜索想从一小时录音里定位某句话几秒钟就能跳到对应位置。成果导出支持三种格式TXT 纯文本适合直接交稿SRT 与 VTT 是主流字幕格式可以无缝导入剪辑软件或视频平台。逐段字幕带精确时间戳边播放边校对改完自动保存五、字幕整形把长句拆短、把碎片并拢做字幕的人都懂机器吐出来的断句经常不合心意长句一屏放不下短句又碎成一片。Buzz 内置了调整字幕功能可以设置目标字幕长度按标点符号自动拆长句也能把间隙小于指定秒数的碎片字幕合并一键批量作用于整份文件。设置完规则再点应用几十条字幕的排版立刻整齐起来。设定目标字数后按标点拆分、按间隙合并整份字幕的节奏立刻顺眼多了六、进阶玩法从转写到自动化工作流基础功能之外Buzz 还有一批值得一试的进阶能力实时录音转录接上麦克风讲话内容即时上屏还带一个演示窗口方便在会议、讲座现场投屏展示字幕。说话人识别转写后尝试区分不同说话人整理多人对谈时省去大量手工标注。语音分离音频嘈杂时先用人声分离把语音抽出来再转写准确率会明显改善。翻译同一段音频可以直接输出成其他语言的文本外语播客、海外课程都能直接变成母语稿。文件夹监控指定一个文件夹之后丢进去的新音频会被自动转录配合批量任务基本能实现放进去就不用管。命令行模式buzz add --task transcribe --model-size small --srt meeting.mp4这样一条命令即可开转适合脚本化、定时任务等自动化场景。插件生态项目内置了 AI 摘要生成、跳过已转写文件、字幕自动缩放等插件安装后可以在功能上继续扩展。七、三个真实场景看看它怎么派上用场会议记录开着实时录音会开完文字稿也基本齐了会后用关键词搜索定位讨论焦点导成 TXT 直接进团队文档。视频字幕导入成片选 large 模型拿最高精度再用字幕整形统一断句节奏导出 SRT 后拖进剪辑软件即可发布。外语学习把外语音频转成字幕再翻译得到双语对照文本配合播放校对比单纯听读更能抓住发音与语序。八、写在最后Buzz 最大的价值是把转录这件原本要么花钱、要么泄露隐私、要么操作繁琐的事变成了本机免费、一次配置长期使用的能力。无论你是整理课堂录音的学生、要处理采访素材的记者还是天天和字幕打交道的创作者都值得把它放进工具箱。想自己折腾源码的开发者也可以直接拉取仓库git clone https://gitcode.com/GitHub_Trending/buz/buzz下次再有录音要转成文字别再一个字一个字敲了。【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考