尧图网站设计 尧图网站设计YAOTU DESIGN
ARTICLE DETAIL

资讯详情

深耕网站设计与一线实操的经验洞察。

Faster-Whisper-TransWithAI-ChickenRice的7个隐藏命令行参数:--overwrite、--output_dir等完整参考清单

Faster-Whisper-TransWithAI-ChickenRice的7个隐藏命令行参数:--overwrite、--output_dir等完整参考清单 Faster-Whisper-TransWithAI-ChickenRice的7个隐藏命令行参数--overwrite、--output_dir等完整参考清单【免费下载链接】Faster-Whisper-TransWithAI-ChickenRice项目地址: https://gitcode.com/gh_mirrors/fa/Faster-Whisper-TransWithAI-ChickenRiceFaster-Whisper-TransWithAI-ChickenRice 是一款基于 Faster Whisper 的免费开源音视频转录与翻译工具把文件拖进窗口即可批量生成字幕。但大多数人不知道它其实内置了 7 个鲜为人知的命令行参数比如--overwrite、--output_dir熟练运用它们能让字幕生成更灵活、更高效。一、先认识这款转录翻译工具 ️Faster-Whisper-TransWithAI-ChickenRice 是一款高性能音视频转录和翻译工具亮点包括高精度日文转中文内置 5000 小时音频数据训练的优化翻译模型多格式字幕支持 SRT、VTT、LRC、TXT 四种字幕格式智能缓存自动跳过已生成字幕的文件批量处理省时省力GPU 加速支持 NVIDIA CUDA 与 AMD ROCm也可纯 CPU 运行参数定义的核心源码位于 infer.py所有参数最终都服务于「扫描音频 → 转录翻译 → 写出字幕」这条流水线。二、如何使用命令行参数3步上手 ️工具默认是「拖拽即用」想解锁隐藏参数只需 3 步找到 .bat 启动脚本项目提供 10 个开箱即用的脚本如 运行(翻译)(GPU).bat(GPU).bat)、运行(转录)(CPU).bat(CPU).bat)用记事本打开任意一个即可在infer.exe命令后追加参数脚本末尾的%*会把你拖入的文件原样传给程序参数加在%*之前即可保存后照常拖入音视频文件运行。修改前的一行命令长这样以 GPU 翻译脚本为例infer.exe --audio_suffixesmp3,wav,flac,m4a,... --sub_formatssrt,vtt,lrc --devicecuda --tasktranslate %*接下来逐个拆解 7 个隐藏参数。三、7个隐藏命令行参数详解 1.--overwrite强制覆盖已有字幕默认情况下工具发现字幕已存在就会直接跳过这是智能缓存机制见 infer.py 扫描逻辑。换过参数重新跑却「没反应」加上它infer.exe --overwrite --tasktranslate %*它会对所有已存在的字幕文件强制重新生成是 FAQ 中「字幕未生成」问题的官方解法。2.--output_dir把字幕存到指定文件夹默认字幕与音频同目录同名输出。想集中管理指定输出目录即可相对路径会以当前工作目录为基准infer.exe --output_dirD:\字幕输出 --sub_formatssrt,lrc %*项目自带的 运行(转录)(GPU)(输出到当前文件夹).bat(GPU)(输出到当前文件夹).bat) 就用了--output_dir输出所有字幕会统一放进「输出」文件夹方便批量导出。3.--task一键切换翻译与转录取值行为适用场景translate翻译输出日文→中文给日剧、动漫配中文字幕transcribe原文转写不翻译整理日文原稿、歌词该参数会覆盖配置文件generation_config.json5 里的task字段。只装了一个模型包也能临时切换任务非常实用。4.--audio_suffixes自定义要处理的文件类型默认只认wav,flac,mp3三种音频。目录里若是 m4a、mkv 等格式加上它让工具「看得见」infer.exe --audio_suffixesmp3,m4a,wav,mkv,mp4 %*项目所有 .bat 脚本默认已配齐 14 种音视频扩展名含 mp4、mkv、avi、webm 等可直接参考。5.--sub_formats一次生成想要的字幕格式程序内置 4 种字幕写手srt通用字幕、vtt网页字幕、lrc歌词格式、txt纯文本。想要 SRT 歌词双格式infer.exe --sub_formatssrt,lrc %*写错格式名如ass会立即报错提示「未知格式」不用等到跑完才发现。6.--enable_batchingGPU 批量推理加速器 ⚡长音频批量处理太慢开启批量推理可把多个片段合并送显卡速度明显提升代价是占用更多显存infer.exe --enable_batching --batch_size4 %*不指定--batch_size时程序会从--max_batch_size默认 8开始自动探测最佳批次大小显存不足OOM还会自动减半重试全程无需人工干预。显存吃紧的用户建议保持默认关闭。7.--console内置的诊断调试控制台 GPU 跑不起来、环境报错看不懂加一个--console程序会先自动执行系统与 Python 环境诊断CUDA 环境变量与显卡检测ONNX Runtime 推理后端检查VAD 语音检测模型初始化测试随后进入交互式 Python 控制台可执行diagnose()、test_vad()等命令深入排查。它是提交 Issue 前收集环境信息的利器。四、完整参数参考清单 除了上述 7 个参数定义源码 中还有一批进阶参数一次列全基础与模型类参数默认值作用--model_name_or_pathmodelsWhisper 主模型路径模型放在子文件夹时需手动指定--deviceauto运行设备cpu/cuda/autoAMD 用户可写amd--compute_typeauto计算精度auto会按设备自动选择最优bfloat16→float16→int8--generation_configgeneration_config.json5转录参数配置文件路径--log_levelDEBUG控制台日志级别设为INFO更清爽VAD 语音检测类参数作用--vad_thresholdVAD 检测阈值0.3–0.7推荐 0.5过大漏翻、过小易「幻听」--vad_min_speech_duration_ms最短有效语音时长毫秒过滤噪声--vad_min_silence_duration_ms最短静音间隔毫秒--vad_speech_pad_ms语音前后填充时间毫秒避免切掉句首句尾智能切分与字幕后处理类参数作用--smart_split_with_vadtrue/false先用外层 VAD 切出安全音频块再逐块转录--target_chunk_duration_s智能切分块目标时长秒上限 30 秒--merge_segments/--no_merge_segments开启/关闭字幕片段合并去重复、去重叠--merge_max_gap_ms相邻字幕间隔不超过该值才允许合并默认 2000--merge_max_duration_ms合并后单条字幕最大时长默认 20000防超长字幕批量推理类参数默认值作用--batch_size自动探测批量推理的固定批次大小--max_batch_size8自动探测时的批次上限位置参数命令行最后直接跟文件或目录路径可多个工具会递归扫描匹配--audio_suffixes的文件。拖拽 .bat 传文件、手动敲命令两种用法完全等价。五、参数组合实战3个常用配方 配方1集中输出 强制重跑换参数后重新生成全部字幕infer.exe --overwrite --output_dirD:\字幕 --sub_formatssrt,vtt,lrc %*配方2显存充足时的速度拉满批量推理 高显存模式infer.exe --enable_batching --devicecuda --tasktranslate %*配方3字幕出现几十秒的超长条缩小合并阈值infer.exe --merge_max_duration_ms8000 --merge_max_gap_ms1500 %*六、延伸阅读与相关文件 资料说明README.md完整项目文档CUDA 版本选择、AMD 显卡对照表、FAQ使用说明.txt详细使用指南与参数配置说明generation_config.json5转录参数配置文件VAD/合并/智能切分均可在此调整infer.py全部命令行参数的定义源码RELEASE_NOTES_CN.md版本更新日志与 CUDA 兼容性选择指南 小贴士命令行参数、.bat 脚本默认值、generation_config.json5 三层配置按「命令行 脚本默认值 配置文件」的优先级生效临时实验加参数、长期调整改配置文件各得其所。【免费下载链接】Faster-Whisper-TransWithAI-ChickenRice项目地址: https://gitcode.com/gh_mirrors/fa/Faster-Whisper-TransWithAI-ChickenRice创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表