尧图网站设计 尧图网站设计YAOTU DESIGN
ARTICLE DETAIL

资讯详情

深耕网站设计与一线实操的经验洞察。

Buzz:免费离线语音转文字,3分钟本地跑起来

Buzz:免费离线语音转文字,3分钟本地跑起来 Buzz:免费离线语音转文字,3分钟本地跑起来【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz两小时的访谈结束了,你想整理出文字稿,却没时间把录音完整再听一遍。外文播客、讲座录音越攒越多,丢给云端转录服务不仅有按量计费的费用,内容隐私也难免让人担心。Buzz 是一款免费开源的桌面应用,基于 OpenAI 的 Whisper 模型,在你的个人电脑上完全离线地完成音频转录与翻译。音频不用上传,不收订阅费,断网环境里也能正常工作。 快速上手:Windows、macOS、Linux 的安装步骤Windows从项目发布页下载最新的 exe 安装包,双击运行即可。程序未做签名,安装时若弹出安全警告,选择更多信息再点仍要运行。首次启动会自动下载 Whisper 模型,tiny 模型仅约 75MB,按电脑性能选择大小。macOS从发布页下载 .dmg 安装包,双击完成安装。Intel 芯片需要 macOS 11.7 及以上版本,Apple Silicon 芯片可获得更好的加速效果。LinuxSnap 方式安装,先装两个系统依赖:sudo apt-get install libportaudio2 libcanberra-gtk-module libcanberra-gtk3-module sudo snap install buzz习惯 Flatpak 的用户,也可以直接运行flatpak install flathub io.github.chidiwilliams.Buzz。Python 跨平台安装需要先装好 ffmpeg,建议使用 Python 3.12 环境:pip install buzz-captions python -m buzz打开应用后,在任务设置里选择语言、模型大小和导出格式即可开始。小模型速度快,大模型准确率高,离线场景建议先跑一遍 tiny 或 small 试试效果。 核心功能实战:从转录到字幕全流程文件导入转录:把音视频丢进队列就能出文字适合整理播客文稿、会议录音这类场景。点工具栏的图标(或文件菜单)导入本地音视频文件,也可以直接粘贴 YouTube 链接导入,免去手动下载。选好语言和模型后点 Run,任务显示完成后双击该行打开转录结果,还能对照时间轴播放校对。实时录音转录:麦克风输入变成即时文字讲座、采访这类场景下,选好语言、转录任务(转录原文或翻译成英文)和麦克风,点 Record 就开始录,文字实时追加到界面,并可选择自动导出为文本文件。想要实时效果好,选 Whisper.cpp 后端配合小模型会更流畅,各转录后端实现见 buzz/transcriber/。字幕调整与导出:按长度重新分段,一键导出 SRT整理完转录想做成字幕时,导入文件时勾选Word-Level Timings,之后在转录视图点 Resize,设置每条字幕的最大长度,按标点拆分,还能给每条字幕延长显示时间。本地仍有原音频时,它会分析静默处来修正字幕时间。最后导出 TXT、SRT 或 VTT 即可。说话人识别:多人对话自动标注谁说了什么访谈和圆桌讨论里最容易混的就是说话人归属。在转录视图点Identify speakers,Buzz 会自动给每位说话人的句子打标签,你可以试听某位说话人 10 秒的随机语句来确认身份,把默认标签改成真实姓名,还能把连续同一个人的句子合并成一段。 谁适合用需要把课堂讲座整理成笔记的学生、赶交付的记者、以及要给视频配字幕的创作者,最匹配的场景就是:手头有一段录音,想在本地把它变成一份带时间戳的 SRT 字幕文件。Buzz 采用 MIT 协议开源,更细的操作说明可以查阅仓库内的 使用文档。当录音量大又在意隐私时,把转录放在本地跑完,省心也省钱。【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表