部署合同

实时流式与字幕

通过 WebSocket 在线或 2-pass 协议处理麦克风、会议字幕和实时语音流。

成熟度
社区验证
FunASR
1.3.29
运行时
Python and C++ WebSocket runtimes
验证日期
2026-07-26

适用边界

先判断它是否适合你的生产约束

适合

  • 实时字幕
  • 客户端持续推送 PCM 音频
  • 需要在线初稿与离线修订

不适合

  • 只转写完整文件
  • 客户端不能处理断线重连和背压
  • 未定义端点与最终结果语义
模型Paraformer-online / FSMN-VAD / CT-Transformer punctuation / Fun-ASR-Nano realtime
硬件cpu / nvidia-gpu / kubernetes
操作系统Linux
接口WebSocket / Python client / C++ client / Go client

运行路径

从安装到已知音频验证

以下命令来自当前验证清单;上线前固定依赖、模型和硬件。

安装

pip install funasr websockets ffmpeg-python

启动

cd runtime/python/websocket && python funasr_wss_server.py --port 10095

健康检查

ss -ltn | grep 10095

Smoke test

发布前必须通过的最小验证

cd runtime/python/websocket && python funasr_wss_client.py --host 127.0.0.1 --port 10095 --mode 2pass --chunk_size "8,8,4" --audio_in ../../tests/test_audio/zh.wav

运行与容量

把可运行推进到可运营

运行检查

  • 监控活动连接、积压音频秒数和最终结果延迟
  • 验证优雅断开与重连
  • 固定 chunk_size、VAD 和标点配置

容量变量

  • 音频时长、语言、声道和 VAD 分段分布
  • 并发、队列等待、预热与模型缓存状态
  • 精确硬件、驱动、运行时和线程配置

故障排查

  • 先用仓库客户端和固定 WAV 验证
  • 确认 PCM16、16 kHz、单声道
  • 分别记录首稿和最终结果时刻

安全边界

生产入口默认不信任

已知限制

真实容量由音频实时比、分块、VAD、连接数和客户端背压共同决定,文件 RTFx 不能替代并发测试。

公开基准仅用于复现起点,不替代目标业务负载测试。

证据与反馈

从原始资料核对部署合同