ARTICLE DETAIL

资讯详情

深耕郑州网站建设与运营推广的一线实战洞察。

FunASR 本地部署指南:内网离线转写音频的一键实操

FunASR 本地部署指南:内网离线转写音频的一键实操 FunASR 本地部署指南内网离线转写音频的一键实操【免费下载链接】FunASROpen-source speech recognition toolkit for training, inference, streaming ASR, VAD, punctuation, speaker diarization pipelines, and OpenAI-compatible/MCP serving.项目地址: https://gitcode.com/GitHub_Trending/fun/FunASR为什么云端转写行不通客服录音、访谈音频、庭审录音合规要求常常是数据不许离开内网走云端 API 这条路直接断了。FunASR 是达摩院开源的语音识别工具包本文的走法是把识别、端点检测、标点补全装进一个 Docker 服务离线转写全程发生在你的机器上不产生任何出网调用。 能力速写三个组件自由拼现成的三块核心组件Paraformer 离线识别模型、FSMN VADVoice Activity Detection语音端点检测判断哪一段有人在说话、标点模型。三者可以在服务内部串成完整流水线也可以单独调用后面按需组合即可。启动前的环境与资源核对Docker 运行时已装好Windows 用 Docker Desktop 并启用 WSL2 后端即可磁盘预留 10GB 以上脚本会先后拉取镜像、下载 ASR/VAD/标点三个模型包部署阶段需要能访问外网拉镜像和模型跑起来之后服务完全本地客户端机器有 Python 3.8要转 mp3、m4a 这类非 wav 格式先装 FFmpeg把服务跑起来从 clone 到 10095 端口git clone https://gitcode.com/GitHub_Trending/fun/FunASR cd FunASR/runtime/deploy_tools预期当前目录下出现 FunASR 仓库deploy_tools里有funasr-runtime-deploy-offline-cpu-zh.sh这个部署脚本。sudo bash funasr-runtime-deploy-offline-cpu-zh.sh install脚本依次拉镜像、下模型、启容器全程带进度条。看到The service has been started.那行日志容器就起来了本地部署完成服务默认监听 10095 端口。curl -k https://127.0.0.1:10095服务默认开着 SSL自签证书的加密通道所以要https加-k跳过证书校验。收到HTTP/1.1 200或 WebSocket 握手响应连通性没问题。️ 把第一段音频转出来客户端在runtime/python/websocket里先装依赖pip install -r runtime/python/websocket/requirements_client.txt预期websockets、pyaudio等依赖安装完成无报错。单文件转写python runtime/python/websocket/funasr_wss_client.py --host 127.0.0.1 --port 10095 \ --mode offline --audio_in ./meeting.wav --output_dir ./out终端会实时打印识别文本跑完./out里生成对应文本文件任务闭环。--mode三档offline整段识别精度最高online流式边说边出字2pass先流式出草稿再整段修正。批量处理时--audio_in改指一个.scp文件每行标签 路径call_01 /data/audio/call01.mp3 call_02 /data/audio/call02.wav两个高频参数--hotword指向热词文件每行词 权重如阿里巴巴 20提升专业术语的召回--use_itn 0关闭数字归一化一百二十三就按原样输出不会被还原成123。不想敲命令线的把runtime/html5/static/index.html拷进浏览器填上服务地址和端口上传音频或直接点麦克风键转写都行。上线前调线程、端口与模型这几项改动都用update子命令写入restart重启后生效并发线程--decode_thread_num、--io_thread_num控制解码与 IO 线程默认 32/8。批量转写时按 CPU 核数的一半左右起步压测改完--show核对当前值端口update --host_port 10096换宿主机端口。验证方式--show里端口已变curl新端口仍返回 200模型替换--asr_model接受模型 ID 或本地路径行业专用模型去 model_zoo/modelscope_models.md 里挑加密开关纯内网且没有加密合规要求时update --ssl 0关闭 SSL客户端连接随之简化接下来去哪一套一键脚本加 WebSocket双向通信协议客户端足够把客服质检、会议归档、访谈转写完全收进自己机器闭环。想继续往下挖从这三处入手runtime/quick_start_zh.md运行时整体速览runtime/docs/websocket_protocol_zh.md服务端与客户端之间的协议细节examples/更多模型的训练与推理用法【免费下载链接】FunASROpen-source speech recognition toolkit for training, inference, streaming ASR, VAD, punctuation, speaker diarization pipelines, and OpenAI-compatible/MCP serving.项目地址: https://gitcode.com/GitHub_Trending/fun/FunASR创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表