FunASR 生态系统
基于 FunASR、SenseVoice、Paraformer 构建的开源项目与集成方案。
视频与媒体工具
10.5K+ stars
实时流式转写服务。已合并的 SenseVoiceSmall backend 接入 LocalAgreement 与 VAC/VAD 流水线,保留 word timestamp,支持自动检测及普通话、粤语、英语、日语和韩语。
实时转写SenseVoiceSmall
13.7K+ stars
v5.2.0-beta2 已提供 Fun-ASR Nano 与 SenseVoice 本地视频字幕引擎,覆盖 Windows、macOS、Linux,并提供 Q4、Q8、F16 模型。PR #13063 更新 CrispASR 运行时并核验 SenseVoice Metal 路径;查看使用与选型。
视频字幕Fun-ASR NanoSenseVoice
语音输入与桌面应用
13.1K+ stars
开源 AI 可穿戴设备与移动应用。已合并的 #10447 增加默认开启的“向 Omi 发送原始音频”开关。关闭后,
raw audio 仅发往所选 STT provider;转写文本和非音频数据仍可发送到 Omi。设备编码不受 Custom STT 支持时会失败关闭,不会回退上传 Omi 音频。STT provider 可配置为 FunASR / SenseVoice 兼容服务。可穿戴设备Custom STT隐私
30K+ stars
跨平台本地 AI 桌面应用。SenseVoice 集成已在 #7436 合并,通过 sherpa-onnx 在 macOS、Linux 和 Windows 离线自动识别中文、英文、日文、韩文和粤语。当前可在 v1.4.159-rc.1 预发布版使用;v1.4.158 稳定版尚不包含。
桌面离线SenseVoice
语音助手与智能体
AI 平台与框架
75K+ stars
可视化工作流与 Agent 平台,已通过 #14225 合并专用 FunASR speech-to-text 组件。默认连接本地
/v1 与 sensevoice,支持可选网关鉴权和语言选择;自托管服务启用 SSRF 防护时,请把服务主机加入 allow-list。WorkflowLocal FunASROpenAI 兼容
88.6K+ stars
开源 RAG 与智能体平台。已合并的 #17388 让本地 FunASR 使用默认
http://localhost:8000/v1 时无需 API key;配置密钥时仍发送 Bearer 认证,并在 multipart 转写前校验模型名,避免缺失配置触发 panic。RAG本地 FunASR可选认证
313 stars
音频模型评测框架。#47 已注册
fun-asr-nano-2512,固定 Hugging Face 模型 revision 与运行依赖,通过隔离子进程执行评测;合并前在 H100 上完成了固定样例 smoke test,结果不代表所有数据集、语言或部署硬件。评测Fun-ASR-Nano可复现 revision
58K stars
训练数据标注与 WebUI 转写支持 Fun-ASR-Nano、SenseVoice 和经典 FunASR 模型。已合并的 #2824 将项目依赖修正为
Transformers >=4.51,<5:4.51 是其验证矩阵中首个可构建 Qwen3 的版本,避免选择 Fun-ASR-Nano 后在转写前触发 KeyError: qwen3。另见 runtime fallback 与 backend 文档。TTS数据集转写Qwen3
54.3K stars
OpenAI 兼容 AI Gateway。FunASR / SenseVoice 可通过
custom_openai 作为自托管语音转写端点接入。AI GatewayOpenAI 兼容
150K stars · 352 installs
FunASR 官方插件 0.1.1 已上线 Dify Marketplace,内置 SenseVoice、Fun-ASR-Nano 与 Paraformer,支持最大 25 MB 音频上传。
官方插件语音转写
SenseVoice 社区扩展
跨平台推理
1.1K+ stars
已合并的 Fun-ASR-Nano 原生实现通过纯 C++ / GGML 在 CPU 或 CUDA 上运行,提供 CLI 与兼容 OpenAI 的本地 HTTP 转写服务。查看固定提交的使用与验证指南。
Fun-ASR-NanoC++ / GGML
7.7K+ stars
面向 Apple Silicon 的原生 MLX 音频运行时。主分支已提供 Fun-ASR-Nano 模型转换、Python/CLI 与 OpenAI 兼容转写,并在 #885 合并统一 hotwords/context 支持。当前路径仅转写、无时间戳,VAD 与说话人分离需外置;模型范围见 Fun-ASR 仓库。
Apple SiliconFun-ASR-NanoOpenAI 兼容
20.7K+ stars
多智能体互动课堂,已通过 #1044 合并原生本地 FunASR provider。按照 配置指南 设置
ASR_FUNASR_BASE_URL 后,可把 WAV 音频发送到 OpenAI 兼容转写端点,并在 SenseVoiceSmall、Paraformer 与 Fun-ASR-Nano 之间选择;无需 API Key。服务端能力与部署边界以 FunASR 仓库 为准。Local ASRMulti-agentOpenAI 兼容
136 stars
开箱即用的本地私有化语音服务。微服务架构,兼容阿里云语音 API 与 OpenAI TTS API,集成 FunASR 和 CosyVoice。
API 服务私有部署
快速上手
pip install funasr # Python API from funasr import AutoModel model = AutoModel(model="iic/SenseVoiceSmall") result = model.generate(input="audio.wav") # 或启动 OpenAI 兼容 API 服务 pip install vllm fastapi uvicorn python-multipart funasr-server --device cuda