尧图网站设计 尧图网站设计YAOTU DESIGN
ARTICLE DETAIL

资讯详情

深耕网站设计与一线实操的经验洞察。

Buzz 本地离线转录指南:免费隐私 Whisper 转写,支持 99+ 种语言

Buzz 本地离线转录指南:免费隐私 Whisper 转写,支持 99+ 种语言 Buzz 本地离线转录指南免费隐私 Whisper 转写支持 99 种语言【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz两小时的客户访谈录音还躺在硬盘里传云端转录要排队声音数据出外网又让人不放心。Buzz 把 OpenAI Whisper 搬到你的电脑上做本地离线转录导入音频全程不联网完成转写结果直接导出成文本或字幕文件。Buzz 能做和不能做的事这一节解决它能不能覆盖你的场景的问题转写音频、视频文件也支持粘贴 YouTube 链接转写麦克风实时转录附带全屏演示窗口讲座授课时投给听众转写结果导出 TXT、SRT、VTT 三种格式字幕可直接进剪辑软件多个 Whisper 后端可选NVIDIA 显卡 CUDA 加速、Apple Silicon、集显 Vulkan转录前先做语音分离嘈杂环境多人对话的准确率更稳识别说话人并在转写中标注文件夹监控新录音放进指定文件夹自动开始转录提供命令行接口CLI批量场景可以写脚本跑核心能力全部在本地完成无需订阅付费插件系统可加挂 AI 摘要、字幕长度自动调整等不需要 GPU、不想折腾安装的同学也可以在终端直接发一条命令完成转写buzz add --model-size small --srt --vtt ./interview.mp3Buzz 安装命令与首次运行这一节解决怎么装、打开后第一件事做什么。分平台各一行macOS下载.dmg安装包打开即用Windows下载安装包提示未签名时点仍要运行Linuxsudo snap install buzz或 Flatpak 安装开发环境先装好 FFmpeg 并使用 Python 3.12再用 pip 安装pip 安装并启动pip install buzz-captions python -m buzz打开后只选一个 Whisper 模型模型自动下载并缓存在本机之后再转写就完全离线。没有注册也没有必须填的配置项。转录完整流程从导入到字幕导出这一节按导入 → 执行 → 校对 → 导出的主线带你完整走完一次转录任务。第 1 步导入媒体文件。点文件菜单的导入媒体文件快捷键 Ctrl/Cmd O或工具栏的号选中音频或视频。接着选任务转录或翻译成英文、语言和模型高级里还能填初始提示——把领域术语、人名写进去可减少这些词被写错。第 2 步点 Run 开始执行。任务进入队列表格逐行显示实时进度一次拖入多段录音会依次排队处理做完自动保存到本地。第 3 步打开转写查看器校对。状态变成 Completed 后双击该行进入查看器搜索框输入关键词直接定位到那一秒拖动进度条回放原声切换倍速快速复查遇到错字直接在表格里改时间戳不对也可以手动微调。第 4 步导出。点导出按钮选格式TXT 出纯文本SRT/VTT 出字幕。想让字幕符合播出习惯点Resize设定每条字幕的目标长度、按合并间隔重新切分用词级时间戳转写出来的文本还能按标点自动断行。关键选项速查模型、后端、导出格式这一节解决选项这么多到底怎么选的问题。选项可选项怎么选模型大小Tiny / Base / Small / Medium / Large含 V2、V3、Turbo求快出草稿选 Tiny 或 Base均衡选 Small精度优先选 Large 系列速度和精度想折中选 Turbo后端Whisper / Faster Whisper / Whisper.cpp / Hugging Face / OpenAI APINVIDIA 卡且有 6GB 以上显存选 Faster Whisper没有 N 卡含 Mac选 Whisper.cpp集显甚至纯 CPU 也能跑小语种覆盖选 Hugging Face 的 MMS 模型族支持 1000 种语言导出格式TXT / SRT / VTT只读文本用 TXT进剪辑软件做字幕用 SRT 或 VTT语音分离开 / 关嘈杂环境、多人对话时打开先把语音从背景中抽出来再转写词级时间戳开 / 关后面打算按长度重新切字幕时打开模型没有万能答案官方建议拿自己的语言样本把几个模型都试一遍再定。现象与对策速查这一节汇总最容易踩的坑按看到什么现象 → 先做什么排列。转录速度慢 → 换更小的模型或启用 CUDA / Vulkan / Apple Silicon 的 GPU 加速输出里出现原文没有的词句幻觉 → Large-V3 偶尔会编造内容换 Large-V2 或 Turbo术语、人名频繁写错 → 在初始提示里填入这些词想在全离线电脑上用 → 先在有网电脑下载好模型帮助 → 偏好设置 → 模型把模型文件夹拷到离线机器的同一路径启动时崩溃 → 多为模型下载不完整删掉重下另注意 CPU 需支持 AVX2实时录音读不到麦克风 → 检查系统隐私设置里是否放行了该应用使用麦克风适合谁用隐私优先的转录场景适合手里有隐私敏感素材访谈、客户通话、内部会议的人适合要批量处理大量录音的人也适合给视频做字幕的人——文件不出机器转录不花订阅费。把你最不敢传云端的那段录音拖进去跑一遍十分钟后就能看到导出目录里干净的文本和字幕文件。官方文档docs/docs/插件源码目录buzz/plugins/【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表