
Buzz 离线语音转文字会议录音不出本机本地转录又快又准【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz录音文件堆满硬盘字幕时间轴全靠手动敲Buzz 基于 OpenAI Whisper 在你电脑上做离线语音转文字音频不出本机还能一键导出 TXT、SRT、VTT。三步跑出第一份离线语音转文字文稿先装好 Buzz。Mac 下载 .dmg 拖进应用程序即可。Windows 从官方发布页下载安装包弹窗提示未签名时点更多信息再点仍要运行。Linux 用 Flatpak 或 Snap 都能装。如果你习惯终端也可以直接装 Python 版pip install buzz-captions python -m buzz然后走最短路径点工具栏图标导入一个音频任务选转录语言手动选好比自动检测更准。挑个模型点运行。状态变已完成后双击那一行边播放边核对文本最后导出。会议录音边录边出文字还能分清谁在说话你要做什么把一场会议实时转成文字。 你点哪里任务选录音选好麦克风点录音。Buzz 会边录边出字。 你得到什么实时滚动的字幕多人访谈时还能标注不同说话人。显示模式有三种建议用追加并校正。它会把上一句的识别错误持续修掉最接近人工记录。多人对话点识别说话人Buzz 给每句话贴标签你还能改成对方真名。要投屏给观众看开一个演示窗口就行。想录电脑里放的声音比如网课或系统音先配一个虚拟音频设备当麦克风再选它录制即可。把视频音轨变成本地转录字幕你要做什么给 MP4、MKV 这类视频配上字幕。 你点哪里导入视频Buzz 自动抽出音轨。高级设置里勾词级时间戳每个词各占一行。 你得到什么逐词的时间轴。再用调整大小按静音间隔和标点拼成标准字幕长度导出 SRT 或 VTT直接挂到播放器或剪辑软件里。想让每条字幕多停一会儿调整大小里还能给每段加固定的延长秒数播放体验更从容。批量转写把整个文件夹丢进去在偏好里指定一个监听文件夹往里丢音频Buzz 会自动建任务。再打开跳过已转录文件插件重复导入同一批文件时它直接复用旧结果不重跑模型。这适合把会议录音固定归档到某个目录的活儿。如果你习惯终端一条命令也能批量处理buzz add --task transcribe --model-size small --srt --vtt 音频文件让 GPU 拉满速度语言选对更准让速度更快⚡ 模型后端换成 Whisper.cppNvidia 显卡自动走 CUDAAMD、Intel 走 Vulkan。显存不够就选量化模型比如 q_5或在偏好里开降低 GPU 内存占用做 8 位量化。没有 Nvidia 卡就用 Whisper.cpp它吃任意品牌显卡也能纯 CPU 跑在 Mac 上最合适。日常草稿用 base 或 small终稿校对上 medium 或 large。让结果更准 手动指定已知语言别靠自动检测。高级设置里填初始提示把人名、产品名等易错词写进去专有名词的拼写就不容易错。嘈杂录音可以开语音提取或者用 DeepFilterNet 插件先降噪再转效果更稳。卡住了怎么办转得太慢换小一号的模型Whisper.cpp 后端可设环境变量BUZZ_WHISPERCPP_N_THREADS调 CPU 线程数。模型下载慢设HF_ENDPOINT指向国内镜像再启动 Buzz。老显卡反而更卡设BUZZ_FORCE_CPUtrue强制走 CPU。录音报错 PaErrorCode-9999检查系统有没有给麦克风权限或临时关一下杀毒软件。启动就崩多半是模型没下全去偏好→模型删掉重下。Buzz 适合会议整理、字幕制作也适合隐私敏感的批量转写——免费开源数据全程不出本机。它不太适合两类需求需要纯云端 API 大规模并发的场景以及追求毫秒级延迟的超高频实时流。项目文档docs/docs转录核心模块buzz/transcriber/【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考