尧图网站设计 尧图网站设计YAOTU DESIGN
ARTICLE DETAIL

资讯详情

深耕网站设计与一线实操的经验洞察。

Buzz 本地转录教程:3 步在电脑上离线完成音频转文字

Buzz 本地转录教程:3 步在电脑上离线完成音频转文字 Buzz 本地转录教程3 步在电脑上离线完成音频转文字【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzzBuzz 是一款开源免费的桌面转录工具它基于 OpenAI 的 Whisper 模型在你的电脑上完成音频转录与翻译适合经常处理会议录音、视频字幕和多语言素材的人。所有音频数据都保留在本地不会上传到任何云端服务。Buzz 是什么离线音频转录工具Buzz 是一个跨平台的桌面应用采用 MIT 开源协议支持 Windows、macOS 和 Linux。它围绕三件事展开导入音频、视频文件或 YouTube 链接进行转录和翻译结果支持导出为 TXT、SRT、VTT 三种格式通过麦克风进行实时录音转录转录结果持续刷新并附带可在活动中投屏的演示窗口支持 Whisper、Whisper.cpp、Faster Whisper 等多种模型后端Nvidia 显卡可用 CUDA 加速Apple Silicon 和多数集成显卡可通过 Vulkan 加速。如何安装 Buzz 并首次运行官方为 Windows 和 macOS 提供了安装文件直接下载运行即可。注意 Windows 程序未做签名安装时若弹出安全警告选择更多信息后点仍要运行macOS 版本目前仅支持 Apple Silicon 芯片。Linux 用户可以用 snap 安装sudo apt-get install libportaudio2 libcanberra-gtk-module libcanberra-gtk3-module sudo snap install buzzPython 用户可以从 PyPI 安装需要 Python 3.12 并提前装好 ffmpegpip install buzz-captions python -m buzz装好后按 4 步完成第一次转录启动应用点击左上角的按钮添加一个本地音频文件。在右侧选择模型默认是 tiny首次使用会自动把模型下载到本地。点击运行按钮任务出现在队列中可以看到进度。转录完成后结果文件导出到源文件同目录双击任务即可在查看器中打开。Buzz 的三个核心功能文件转录、实时录音与字幕编辑下面三个功能覆盖了日常大部分使用场景。文件转录与翻译。导入任意音频或视频文件在 tiny、base、small、medium、large 中选择模型大小单击即可完成转录也可以把任务直接设为翻译成目标语言。适合给视频上字幕、整理采访录音这类一次性任务。实时录音转录。点击主窗口上的麦克风图标开始录音句子会边说边显示。会议或演讲时可以切到演示窗口把最新转录内容投屏。适合会议记录和课堂笔记。转录查看与编辑。内置查看器支持按文本搜索分段、播放音频并调节倍速可以直接修改每句的文字和时间戳导出前逐条微调。Buzz 字幕制作工作流从视频到 SRT以给一个讲座视频配字幕为例完整流程如下导入视频文件选择 medium 模型重要内容建议用更大模型。转录完成后导出 SRT 格式的结果。在队列中打开查看器边播放边修正个别字幕的措辞和时间。如果某条字幕太长来不及读完用字幕 resize 功能自动调整长度。把 SRT 文件导入你的视频编辑软件合成成片。提升效率的技巧文件夹监控与 GPU 加速文件夹监控在 Preferences → Folder Watch 里设置监控目录往里面放入新音频就会自动转录省掉手动导入。GPU 加速Whisper.cpp 后端走 Vulkan大多数显卡含集成显卡都能用Nvidia 显卡可选 CUDA 后端。模型下载与管理都在 Preferences → Models 里完成。Buzz 常见问题4 个高频坑这几个是新手最容易碰到的情况Windows 安装提示未知发布者程序未签名点更多信息选仍要运行即可属正常现象。转录速度很慢改用 tiny 或 base 模型或启用 GPU 加速large 模型在纯 CPU 上会慢很多。转录准确率不高换更大的模型用initial prompt功能给模型补充上下文嘈杂音频开启语音分离再转录。Intel Mac 上无法运行新版本要求 Apple SiliconIntel 机型最后一个可用版本是 1.4.5。更多功能细节可查官方文档docs/docs/index.md。Buzz 适合不想把音频交给云端服务、希望数据留在自己设备上的人会议组织者、视频创作者和需要整理课程录音的学生都是典型用户。建议先用 tiny 模型转录一段短音频熟悉界面再根据你的硬件和精度需求调整模型或开启文件夹监控。【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表