尧图网站设计 尧图网站设计YAOTU DESIGN
ARTICLE DETAIL

资讯详情

深耕网站设计与一线实操的经验洞察。

Buzz 完整指南:3 步跑通离线转录与字幕导出

Buzz 完整指南:3 步跑通离线转录与字幕导出 Buzz 完整指南3 步跑通离线转录与字幕导出【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzzBuzz 是一个完全离线运行在你个人电脑上的音频转录工具由 OpenAI Whisper 驱动。音频文件与麦克风实时输入都在本地转成文字数据不上传任何服务器还能直接导出字幕。本文帮你在 10 分钟内完成安装并产出第一条转录结果。项目速览一句话定义基于 OpenAI Whisper 的本地音频转录与翻译工具核心能力文件/YouTube 链接转录、麦克风实时录音、多后端模型CUDA / Apple Silicon / Vulkan 加速、TXT/SRT/VTT 导出、插件系统支持平台Windows、macOS、Linux开源协议MIT仓库地址https://gitcode.com/GitHub_Trending/buz/buzz它解决什么问题维度在线转录服务Buzz 本地方案隐私音频上传到第三方服务器数据全程留在本机网络必须联网模型手动迁移后可完全离线成本按时长或订阅计费免费输入受平台格式限制MP3、MP4、WAV、YouTube 链接均可一句话总结敏感录音会议、采访、培训不必出机器精度不够时换更大模型即可不用为流量和时长付费。 从零到跑通Windows从官方发布渠道下载.exe安装程序双击安装。程序未签名安装时若出现安全警告选More info-Run anyway即可。macOS下载官方.dmg把 Buzz 拖进 Applications 文件夹打开后若提示未验证开发者在系统设置中允许一次。LinuxFlatpak 或 Snap 二选一# Flatpak 方式 flatpak install flathub io.github.chidiwilliams.Buzz # Snap 方式先装音频依赖 sudo apt-get install libportaudio2 libcanberra-gtk-module libcanberra-gtk3-module sudo snap install buzzPython 环境需要 Python 3.12 并先装好 ffmpeg然后执行pip install buzz-captions。验证运行python -m buzz弹出主窗口即安装成功。首次启动 3 步走在任务行选择转录模型新手建议Whisper.cpp的small首次使用会自动下载。点工具栏导入本地音频或点 URL 图标粘贴链接。任务选 Transcribe 后点开始状态变为 Completed 后双击该行进入转录编辑器。核心功能拆解多格式导入与任务队列支持音频、视频文件和 YouTube 链接所有任务在一个表格里排队执行。把一整批采访录音拖进去每行独立显示 Queued / In Progress / Completed 状态互不阻塞。关键位置工具栏四个按钮——麦克风实时录音、添加文件、导入 URL、停止任务。实时录音转录麦克风输入实时转文字并提供独立的全屏演示窗口。讲座或发布会场景把演示窗口投到大屏上现场观众看到的文字与说话同步也可以让文字边生成边写入本地 txt 文件接入 OBS 当直播字幕用。关键配置Help - Preferences中勾选 Live transcript exports 开启实时文件导出。多后端模型管理Whisper、Faster Whisper、Whisper.cpp、Hugging Face 四个后端各有所长Mac 用户选 Whisper.cpp 最合适NVIDIA 显卡 6GB 以上显存选 Faster Whisper 速度快一个量级想试多语言定制模型就走 Hugging Face。关键路径模型缓存位于 Linux 的~/.cache/Buzz、macOS 的~/Library/Caches/Buzz、Windows 的%USERPROFILE%\AppData\Local\Buzz\Buzz\Cache把 models 文件夹拷到离线机器上就能断网使用。转录编辑与字幕导出带时间戳的转录结果可以逐段改文本、调起止时间还能按字幕长度自动合并与切分。视频字幕场景转录完成后选区、点 Resize 自动断句再点 Export 得到 SRT。导出支持 TXT、SRT、VTT 三种格式工具栏的 Translate 菜单可把全文翻译成目标语言实现双语对照。 两个实战场景场景 A每天 1 小时会议录音整理导入会议录音文件或直接开麦克风边开会边录。模型选Whisper.cpp的small语言留空自动检测。转录完成后双击任务行在编辑器里改正人名和术语。导出 TXT 作会议纪要需要字幕就改导 SRT/VTT。场景 B批量处理 自动导出字幕用 CLI 一次加入多个文件转录完成直接产出字幕文件全程不用点界面buzz add --model-type whispercpp --model-size small \ --task transcribe --srt --vtt \ ./meetings/01.mp3 ./meetings/02.mp4再加--hide-gui可以隐藏主窗口配合脚本做无人值守批处理。⚡ 性能与调优配置档位推荐模型推荐后端预期效果备注低端 CPU / 8GBtiny、baseWhisper.cpp快精度基础关掉占内存的应用中端 CPU / 16GBsmall、mediumWhisper.cpp速度与精度平衡线程默认半核数NVIDIA / 6GB 显存medium、largeFaster Whisper速度快数倍需装 CUDA 12Mac M 系列small、mediumWhisper.cpp可做实时转录该平台首选完全离线任意手动迁移模型断网可用从Help - Preferences - Models查看缓存位置踩坑提醒8GB 内存别硬上 Large 模型用 medium 以下或在模型偏好里选 q5 量化版本。Buzz 需要 CPU 支持 AVX2很老的机器会直接起不来。个别老显卡上 GPU 反而比 CPU 慢可设环境变量BUZZ_FORCE_CPUtrue强制走 CPU。常见问题现象原因处理启动即崩溃模型文件下载不完整在 Models 偏好里删除后重新下载麦克风报 PaErrorCode-9999系统隐私设置拦截Windows 到 设置 - 隐私 - 麦克风 中允许 Buzz转录太慢模型过大或未启用加速换小模型或改用 Whisper.cpp / Faster Whisper 后端PyPI 版报 ffmpeg 缺失未安装依赖先装 ffmpeg 再运行python -m buzz资源与社区使用文档安装、CLI、FAQ、偏好设置仓库docs/docs/目录插件目录AI 摘要、字幕自动缩放等plugins/问题反馈与讨论到仓库 Issues 区提交附日志更容易被复现仓库地址见项目速览中的 gitcode 链接MIT 协议开源欢迎提交代码或翻译。【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表