适用边界
先判断它是否适合你的生产约束
适合
- 准备上线或扩容
- 需要容量、就绪和安全边界
- 需要可审计的发布与回滚
不适合
- 用单次演示结果代替容量测试
- 省略网关和访问控制
- 没有版本、模型和硬件记录的性能比较
| 模型 | All supported deployment models |
|---|---|
| 硬件 | cpu / nvidia-gpu / desktop-edge-gpu / kubernetes |
| 操作系统 | Linux / macOS / Windows / Kubernetes |
| 接口 | HTTP / WebSocket / CLI / C++ |
运行路径
从安装到已知音频验证
以下命令来自当前验证清单;上线前固定依赖、模型和硬件。
安装
git clone https://github.com/modelscope/FunASR.git
启动
Run the selected runtime with pinned versions and an immutable model cache
健康检查
Verify readiness, model identity, and one known-audio transcript
Smoke test
发布前必须通过的最小验证
Record version, model digest, hardware, warmup, audio duration, concurrency, latency, and output before promotion
运行与容量
把可运行推进到可运营
运行检查
- 区分存活、就绪和业务 smoke test
- 容量测试包含预热、队列和音频分布
- 发布保留模型、配置和上一版本回滚点
容量变量
- 音频时长、语言、声道和 VAD 分段分布
- 并发、队列等待、预热与模型缓存状态
- 精确硬件、驱动、运行时和线程配置
故障排查
- 先确认模型和运行时精确版本
- 使用已知音频区分基础设施与质量回归
- 故障时先回滚再做在线试错
安全边界
生产入口默认不信任
- 网络入口默认拒绝并最小授权
- 上传、日志、缓存和临时文件有保留策略
- 凭证、音频和预签名 URL 不写入普通日志
已知限制
清单不能替代目标业务的负载、准确率、故障和安全演练。
公开基准仅用于复现起点,不替代目标业务负载测试。
证据与反馈