尧图网站设计 尧图网站设计YAOTU DESIGN
ARTICLE DETAIL

资讯详情

深耕网站设计与一线实操的经验洞察。

FunASR:本地离线转写部署,从克隆到首次出文本只要3步

FunASR:本地离线转写部署,从克隆到首次出文本只要3步 FunASR本地离线转写部署从克隆到首次出文本只要3步【免费下载链接】FunASROpen-source speech recognition toolkit for training, inference, streaming ASR, VAD, punctuation, speaker diarization pipelines, and OpenAI-compatible/MCP serving.项目地址: https://gitcode.com/GitHub_Trending/fun/FunASR有一批会议录音、客服录音要转成文字又不方便上传到云端你需要的就是一套跑在自己机器上的本地离线转写服务。FunASR 正好做这件事覆盖语音识别、VAD 切分和标点补全纯 CPU 即可运行本地部署。FunASR 是阿里达摩院语音实验室开源的语音识别工具包从模型训练、流式推理到文本后处理都有现成方案服务端提供开箱即用的 Docker 部署方式。下面直接进入部署。上图是 FunASR 的整体架构模型库、训练推理库、运行时与服务层分离本地部署只用到运行时和服务层。前置条件项目要求说明系统Ubuntu 18.04 / CentOS 764位服务通过 Docker 运行Windows 需先进入 WSL2CPU4 核及以上纯 CPU 推理不需要 GPU内存8GB 及以上需同时加载 ASR、VAD、标点三个模型Docker已安装并可运行脚本在缺失时会自动安装网络可访问模型源与镜像仓库首次部署需下载镜像和模型Windows 用户先在系统设置中开启 WSL2 并装好 Linux 发行版后续所有命令都在该 Linux 环境内执行。FunASR 本地离线转写服务三步启动离线转写的处理链路VAD 先切分音频声学模型解码出文字最后做标点预测和逆文本规范化ITN。拉取源码部署脚本放在仓库的 部署脚本目录 下先克隆仓库并进入该目录。git clone https://gitcode.com/GitHub_Trending/fun/FunASR cd FunASR/runtime/deploy_tools能看到funasr-runtime-deploy-offline-cpu-zh.sh文件即拉取成功。安装并启动服务执行部署脚本它会按需安装 Docker、拉取镜像然后交互选择 ASR、VAD、标点模型端口默认 10095按提示选择后一路确认即可。sudo bash funasr-runtime-deploy-offline-cpu-zh.sh install docker ps | grep funasrfunasr-runtime-deploy-offline-cpu-zh.sh跑完且docker ps输出中容器状态为 Up 即成功中途报模型下载错误则跳到文末排查。跑通第一次调用用仓库自带的 WebSocket 客户端发一个文件转写请求cd runtime/python/websocket python funasr_wss_client.py --host 127.0.0.1 --port 10095 --mode offline --audio_in path/to/audio.wav把path/to/audio.wav换成实际文件路径wav、mp3 等常见格式均可终端打印出的就是带标点、数字已规范化的转写文本若报 SSL 连接错误在命令末尾追加--ssl 0。不想敲命令也可以走 Web 客户端浏览器打开runtime/html5/static/index.html输入 wss 地址和端口上传文件即可看到转写结果。页面支持本地文件上传和麦克风实时录音两种输入方式。多个文件可以批量处理准备一个wav.scp每行一条音频名 文件路径替换--audio_in参数并加--output_dir ./result转写文本会按音频名逐个写入输出目录。调优与排错部署脚本默认把解码线程设为 CPU 核心数、IO 线程设为解码线程除以 4。内存偏紧或机器核数很多时把解码线程降到核心数除以 2重新执行一次部署命令让配置生效。常见问题服务起不来日志提示 10095 端口已被占用 → 其他进程占用了该端口 → 用netstat -tlnp | grep 10095找到进程并停掉或换一个端口重新部署。执行脚本时报docker: command not found→ 系统未安装 Docker → 重新执行部署脚本的 install 子命令它会自动完成 Docker 安装。模型下载中断或速度很慢 → 到模型源的网络不稳定 → 检查网络后重跑同一条 install 命令即可继续部署。这套 Docker 部署适合音频文件不出本机、多个客户端共用一个转写服务的本地离线场景。完整参数与 GPU 部署方式见 离线部署进阶指南踩坑时先到 常见问题文档 里查一下。【免费下载链接】FunASROpen-source speech recognition toolkit for training, inference, streaming ASR, VAD, punctuation, speaker diarization pipelines, and OpenAI-compatible/MCP serving.项目地址: https://gitcode.com/GitHub_Trending/fun/FunASR创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表