适用边界
先判断它是否适合你的生产约束
适合
- 实时字幕
- 客户端持续推送 PCM 音频
- 需要在线初稿与离线修订
不适合
- 只转写完整文件
- 客户端不能处理断线重连和背压
- 未定义端点与最终结果语义
| 模型 | Paraformer-online / FSMN-VAD / CT-Transformer punctuation / Fun-ASR-Nano realtime |
|---|---|
| 硬件 | cpu / nvidia-gpu / kubernetes |
| 操作系统 | Linux |
| 接口 | WebSocket / Python client / C++ client / Go client |
运行路径
从安装到已知音频验证
以下命令来自当前验证清单;上线前固定依赖、模型和硬件。
安装
pip install funasr websockets ffmpeg-python
启动
cd runtime/python/websocket && python funasr_wss_server.py --port 10095
健康检查
ss -ltn | grep 10095
Smoke test
发布前必须通过的最小验证
cd runtime/python/websocket && python funasr_wss_client.py --host 127.0.0.1 --port 10095 --mode 2pass --chunk_size "8,8,4" --audio_in ../../tests/test_audio/zh.wav
运行与容量
把可运行推进到可运营
运行检查
- 监控活动连接、积压音频秒数和最终结果延迟
- 验证优雅断开与重连
- 固定 chunk_size、VAD 和标点配置
容量变量
- 音频时长、语言、声道和 VAD 分段分布
- 并发、队列等待、预热与模型缓存状态
- 精确硬件、驱动、运行时和线程配置
故障排查
- 先用仓库客户端和固定 WAV 验证
- 确认 PCM16、16 kHz、单声道
- 分别记录首稿和最终结果时刻
安全边界
生产入口默认不信任
- 在反向代理限制来源、连接数和消息大小
- 使用 TLS WebSocket
- 不在 URL 查询参数传递长期凭证
已知限制
真实容量由音频实时比、分块、VAD、连接数和客户端背压共同决定,文件 RTFx 不能替代并发测试。
公开基准仅用于复现起点,不替代目标业务负载测试。
证据与反馈