-
Notifications
You must be signed in to change notification settings - Fork 2k
Expand file tree
/
Copy pathecosystem.html
More file actions
406 lines (390 loc) · 25 KB
/
Copy pathecosystem.html
File metadata and controls
406 lines (390 loc) · 25 KB
1
2
3
4
5
6
7
8
9
10
11
12
13
14
15
16
17
18
19
20
21
22
23
24
25
26
27
28
29
30
31
32
33
34
35
36
37
38
39
40
41
42
43
44
45
46
47
48
49
50
51
52
53
54
55
56
57
58
59
60
61
62
63
64
65
66
67
68
69
70
71
72
73
74
75
76
77
78
79
80
81
82
83
84
85
86
87
88
89
90
91
92
93
94
95
96
97
98
99
100
101
102
103
104
105
106
107
108
109
110
111
112
113
114
115
116
117
118
119
120
121
122
123
124
125
126
127
128
129
130
131
132
133
134
135
136
137
138
139
140
141
142
143
144
145
146
147
148
149
150
151
152
153
154
155
156
157
158
159
160
161
162
163
164
165
166
167
168
169
170
171
172
173
174
175
176
177
178
179
180
181
182
183
184
185
186
187
188
189
190
191
192
193
194
195
196
197
198
199
200
201
202
203
204
205
206
207
208
209
210
211
212
213
214
215
216
217
218
219
220
221
222
223
224
225
226
227
228
229
230
231
232
233
234
235
236
237
238
239
240
241
242
243
244
245
246
247
248
249
250
251
252
253
254
255
256
257
258
259
260
261
262
263
264
265
266
267
268
269
270
271
272
273
274
275
276
277
278
279
280
281
282
283
284
285
286
287
288
289
290
291
292
293
294
295
296
297
298
299
300
301
302
303
304
305
306
307
308
309
310
311
312
313
314
315
316
317
318
319
320
321
322
323
324
325
326
327
328
329
330
331
332
333
334
335
336
337
338
339
340
341
342
343
344
345
346
347
348
349
350
351
352
353
354
355
356
357
358
359
360
361
362
363
364
365
366
367
368
369
370
371
372
373
374
375
376
377
378
379
380
381
382
383
384
385
386
387
388
389
390
391
392
393
394
395
396
397
398
399
400
401
402
403
404
405
406
<!DOCTYPE html>
<html lang="zh">
<head><meta http-equiv="Cache-Control" content="no-cache, no-store, must-revalidate"><meta http-equiv="Pragma" content="no-cache"><meta http-equiv="Expires" content="0">
<meta charset="utf-8">
<meta name="viewport" content="width=device-width,initial-scale=1">
<title>FunASR 生态 — 集成 FunASR 的开源项目</title>
<meta name="description" content="超过 50 个开源项目集成了 FunASR 语音识别:会议转写、视频字幕、语音输入、AI 智能体等。">
<link rel="icon" href="logo.png">
<meta property="og:title" content="FunASR 生态 — 集成 FunASR 的开源项目">
<meta property="og:description" content="50+ 开源项目使用 FunASR 进行语音识别,涵盖视频处理、语音输入、AI 平台等领域。">
<meta property="og:type" content="article">
<meta property="og:url" content="https://www.funasr.com/ecosystem.html">
<meta property="og:image" content="https://www.funasr.com/logo.png">
<link rel="canonical" href="https://www.funasr.com/ecosystem.html">
<link rel="alternate" hreflang="zh" href="https://www.funasr.com/ecosystem.html">
<link rel="alternate" hreflang="en" href="https://www.funasr.com/en/ecosystem.html">
<link rel="alternate" hreflang="x-default" href="https://www.funasr.com/en/ecosystem.html">
<link href="https://fonts.googleapis.com/css2?family=Inter:wght@400;500;600;700;800&display=swap" rel="stylesheet">
<script type="application/ld+json">
{"@context":"https://schema.org","@type":"Article","headline":"FunASR 生态:集成项目与应用","author":{"@type":"Organization","name":"通义实验室"},"datePublished":"2026-05-31","description":"超过 50 个开源项目集成 FunASR 语音识别技术。"}
</script>
<style>
:root{--primary:#2563eb;--primary-dark:#1d4ed8;--bg:#fff;--surface:#f8fafc;--border:#e2e8f0;--text:#0f172a;--text-soft:#475569;--text-muted:#94a3b8;--radius:12px;--green:#16a34a}
*{margin:0;padding:0;box-sizing:border-box}
body{font-family:'Inter',-apple-system,sans-serif;color:var(--text);line-height:1.7;-webkit-font-smoothing:antialiased}
a{color:var(--primary);text-decoration:none}
a:hover{text-decoration:underline}
.container{max-width:900px;margin:0 auto;padding:0 24px}
.nav{position:fixed;top:0;left:0;right:0;z-index:100;background:rgba(255,255,255,0.9);backdrop-filter:blur(12px);border-bottom:1px solid var(--border);padding:14px 0}
.nav .container{max-width:1120px;display:flex;align-items:center;gap:24px}
.nav-logo{font-size:1.2rem;font-weight:800;color:var(--text);text-decoration:none}
.nav-logo span{color:var(--primary)}
.nav-links{display:flex;gap:20px;margin-left:auto}
.nav-links a{font-size:0.85rem;font-weight:500;color:var(--text-soft);text-decoration:none}
.nav-btn{padding:7px 16px;background:var(--primary);color:white;border-radius:7px;font-size:0.83rem;font-weight:600;text-decoration:none}
article{padding:120px 0 80px}
h1{font-size:2rem;font-weight:800;line-height:1.3;margin-bottom:8px}
.subtitle{font-size:1.05rem;color:var(--text-soft);margin-bottom:32px}
h2{font-size:1.3rem;font-weight:700;margin:40px 0 16px;padding-top:16px;border-top:1px solid var(--border)}
h2:first-of-type{border-top:none;margin-top:0}
p{margin-bottom:14px;color:var(--text-soft)}
.card-grid{display:grid;grid-template-columns:repeat(auto-fill,minmax(260px,1fr));gap:16px;margin:16px 0}
.card{border:1px solid var(--border);border-radius:var(--radius);padding:20px;background:var(--bg);transition:box-shadow 0.2s}
.card:hover{box-shadow:0 4px 12px rgba(0,0,0,0.08)}
.card-title{font-weight:700;font-size:0.95rem;margin-bottom:4px}
.card-title a{color:var(--text)}
.card-stars{font-size:0.78rem;color:var(--text-muted);margin-bottom:8px}
.card-desc{font-size:0.84rem;color:var(--text-soft);line-height:1.5}
.card-tag{display:inline-block;font-size:0.72rem;font-weight:600;padding:2px 8px;border-radius:4px;background:#eff6ff;color:var(--primary);margin-right:4px;margin-top:8px}
.card-tag.green{background:#f0fdf4;color:var(--green)}
.stat-bar{display:flex;gap:32px;margin:24px 0;flex-wrap:wrap}
.stat{text-align:center}
.stat-num{font-size:2rem;font-weight:800;color:var(--primary)}
.stat-label{font-size:0.82rem;color:var(--text-muted)}
pre{background:#1e293b;color:#e2e8f0;padding:18px;border-radius:10px;overflow-x:auto;font-size:0.82rem;line-height:1.7;margin:14px 0}
.cta{background:var(--surface);border:1px solid var(--border);border-radius:var(--radius);padding:28px;margin:36px 0;text-align:center}
.cta p{margin-bottom:16px}
.cta a.btn{display:inline-block;padding:10px 24px;background:var(--primary);color:white;border-radius:8px;font-weight:600;text-decoration:none;margin:0 6px}
.cta a.btn:hover{background:var(--primary-dark)}
.cta a.btn.outline{background:transparent;color:var(--primary);border:1px solid var(--primary)}
footer{background:#0f172a;color:#94a3b8;padding:32px 0;font-size:0.82rem;text-align:center;margin-top:60px}
footer a{color:#60a5fa}
@media(max-width:640px){h1{font-size:1.5rem}.stat-bar{gap:20px}.stat-num{font-size:1.5rem}.card-grid{grid-template-columns:1fr}}
</style>
</head>
<body>
<nav class="nav"><div class="container"><a class="nav-logo" href="./">Fun<span>ASR</span></a><div class="nav-links"><a href="/#capabilities">核心能力</a><a href="/#usage">如何使用</a><a href="/#benchmark">性能</a><a href="/#demo">演示</a><a href="https://modelscope.github.io/FunASR/zh/" target="_blank">文档</a><a href="quickstart.html">快速上手</a><a href="models.html">模型</a><a href="ecosystem.html">生态</a><a href="/blog/">技术博客</a><a href="vs-whisper.html">对比 Whisper</a><a href="/donors.html">功德榜</a><a href="en/ecosystem.html" style="font-size:0.85rem;font-weight:500;color:var(--text-soft);text-decoration:none">EN</a><a href="https://github.com/modelscope/FunASR" target="_blank" class="nav-btn">GitHub ★</a></div></div></nav>
<article>
<div class="container">
<h1>FunASR 生态系统</h1>
<p class="subtitle">基于 FunASR、SenseVoice、Paraformer 构建的开源项目与集成方案。</p>
<div class="stat-bar">
<div class="stat"><div class="stat-num">50+</div><div class="stat-label">集成项目</div></div>
<div class="stat"><div class="stat-num">50+</div><div class="stat-label">支持语种</div></div>
<div class="stat"><div class="stat-num">35K+</div><div class="stat-label">GitHub Stars</div></div>
<div class="stat"><div class="stat-num">100万+</div><div class="stat-label">月安装量</div></div>
</div>
<h2>视频与媒体工具</h2>
<div class="card-grid">
<div class="card">
<div class="card-title"><a href="/go/funclip">FunClip</a></div>
<div class="card-stars">6K+ stars</div>
<div class="card-desc">基于语音识别的智能视频剪辑。自动生成字幕,支持按关键词和说话人剪辑视频片段。<a href="https://github.com/modelscope/FunClip/releases/tag/v2.1.0">下载 v2.1.0</a></div>
<div><span class="card-tag">视频</span><span class="card-tag green">官方</span></div>
</div>
<div class="card">
<div class="card-title"><a href="https://github.com/jianchang512/pyvideotrans">pyVideoTrans</a></div>
<div class="card-stars">17.6K stars</div>
<div class="card-desc">视频翻译工具。使用 FunASR 进行中文语音识别,自动生成和翻译字幕。</div>
<div><span class="card-tag">视频</span><span class="card-tag">翻译</span></div>
</div>
<div class="card">
<div class="card-title"><a href="https://github.com/abus-aikorea/voice-pro">Voice-Pro</a></div>
<div class="card-stars">10.4K stars</div>
<div class="card-desc">Gradio WebUI 音频处理工具箱,集成 TTS、语音克隆与 ASR 能力。</div>
<div><span class="card-tag">音频</span><span class="card-tag">TTS</span></div>
</div>
<div class="card">
<div class="card-title"><a href="https://github.com/Kedreamix/Linly-Dubbing">Linly-Dubbing</a></div>
<div class="card-stars">3.2K stars</div>
<div class="card-desc">AI 视频配音工具包。自动语音识别、翻译和语音克隆,实现多语言视频配音。</div>
<div><span class="card-tag">配音</span><span class="card-tag">视频</span></div>
</div>
</div>
<h2>语音输入与桌面应用</h2>
<div class="card-grid">
<div class="card">
<div class="card-title"><a href="https://github.com/HaujetZhao/CapsWriter-Offline">CapsWriter-Offline</a></div>
<div class="card-stars">5.5K stars</div>
<div class="card-desc">PC 端语音输入工具。按住 CapsLock 说话,松开自动上屏。基于 FunASR Paraformer 离线识别。</div>
<div><span class="card-tag">桌面</span><span class="card-tag">语音输入</span></div>
</div>
<div class="card">
<div class="card-title"><a href="https://github.com/Open-Less/openless">OpenLess</a></div>
<div class="card-stars">1.8K stars</div>
<div class="card-desc">macOS/Windows 语音输入工具。按住快捷键说话,松开即得润色后的文字。使用 SenseVoice 模型。</div>
<div><span class="card-tag">桌面</span><span class="card-tag">macOS</span></div>
</div>
<div class="card">
<div class="card-title"><a href="https://github.com/stablyai/orca">Orca</a></div>
<div class="card-stars">30K+ stars</div>
<div class="card-desc">跨平台本地 AI 桌面应用。SenseVoice 集成已在 <a href="https://github.com/stablyai/orca/pull/7436">#7436</a> 合并,通过 sherpa-onnx 在 macOS、Linux 和 Windows 离线自动识别中文、英文、日文、韩文和粤语。当前可在 <a href="https://github.com/stablyai/orca/releases/tag/v1.4.159-rc.1">v1.4.159-rc.1 预发布版</a>使用;v1.4.158 稳定版尚不包含。</div>
<div><span class="card-tag">桌面</span><span class="card-tag">离线</span><span class="card-tag">SenseVoice</span></div>
</div>
<div class="card">
<div class="card-title"><a href="https://github.com/yan5xu/ququ">ququ</a></div>
<div class="card-stars">2.2K stars</div>
<div class="card-desc">开源 Wispr Flow 替代方案。集成 FunASR 本地模型和可配置大语言模型的桌面语音工作流。</div>
<div><span class="card-tag">桌面</span><span class="card-tag">语音输入</span></div>
</div>
<div class="card">
<div class="card-title"><a href="https://github.com/HG-ha/MTools">MTools</a></div>
<div class="card-stars">1.2K stars</div>
<div class="card-desc">多功能桌面应用程序,集成音视频处理、图片编辑和 AI 增强语音转写。</div>
<div><span class="card-tag">桌面</span><span class="card-tag">工具箱</span></div>
</div>
<div class="card">
<div class="card-title"><a href="https://github.com/233stone/vocotype-cli">VocoType</a></div>
<div class="card-stars">704 stars</div>
<div class="card-desc">本地端侧隐私安全语音输入工具。通过快捷键将语音实时转文字并自动输入。支持 MCP 集成。</div>
<div><span class="card-tag">语音输入</span><span class="card-tag">隐私</span></div>
</div>
<div class="card">
<div class="card-title"><a href="https://github.com/TheDeathDragon/LiveTranslate">LiveTranslate</a></div>
<div class="card-stars">325 stars</div>
<div class="card-desc">实时音频翻译工具。捕获系统声音和麦克风,使用 SenseVoice 识别后 LLM 流式翻译显示。</div>
<div><span class="card-tag">翻译</span><span class="card-tag">实时</span></div>
</div>
<div class="card">
<div class="card-title"><a href="https://github.com/LeonardNJU/VocoType-linux">VocoType-linux</a></div>
<div class="card-stars">139 stars</div>
<div class="card-desc">高性能 Linux 离线中文语音输入法。基于 FunASR,0.1 秒瞬时上屏,支持 IBus/Fcitx5。</div>
<div><span class="card-tag">Linux</span><span class="card-tag">输入法</span></div>
</div>
<div class="card">
<div class="card-title"><a href="https://github.com/hssstg/murmur">Murmur</a></div>
<div class="card-stars">103 stars</div>
<div class="card-desc">macOS 离线语音转文字工具。按键说话即用,支持任意应用内使用,完全本地处理。</div>
<div><span class="card-tag">macOS</span><span class="card-tag">语音输入</span></div>
</div>
<div class="card">
<div class="card-title"><a href="https://github.com/joe223/AriaType">AriaType</a></div>
<div class="card-stars">74 stars</div>
<div class="card-desc">语音驱动的桌面写作工具。支持语音输入、文本润色和跨应用协作。</div>
<div><span class="card-tag">桌面</span><span class="card-tag">写作</span></div>
</div>
<div class="card">
<div class="card-title"><a href="https://github.com/vorojar/VoiceSnap">VoiceSnap</a></div>
<div class="card-stars">73 stars</div>
<div class="card-desc">纯离线语音输入工具,Typeless 免费平替。SenseVoice + DirectML,数据永不出设备,适合涉密场景。</div>
<div><span class="card-tag">离线</span><span class="card-tag">安全</span></div>
</div>
</div>
<h2>语音助手与智能体</h2>
<div class="card-grid">
<div class="card">
<div class="card-title"><a href="https://github.com/xszyou/Fay">Fay 数字人</a></div>
<div class="card-stars">12.8K stars</div>
<div class="card-desc">数字人 Agent 框架,连接 2.5D/3D 虚拟人与大语言模型。使用 FunASR 实时语音识别。</div>
<div><span class="card-tag">数字人</span><span class="card-tag">智能体</span></div>
</div>
<div class="card">
<div class="card-title"><a href="https://github.com/duixcom/Duix-Avatar">Duix 数字人</a></div>
<div class="card-stars">13.4K stars</div>
<div class="card-desc">开源 AI 数字人工具包,支持离线视频生成和实时交互。使用 FunASR 进行语音识别。</div>
<div><span class="card-tag">数字人</span><span class="card-tag">视频生成</span></div>
</div>
<div class="card">
<div class="card-title"><a href="https://github.com/wzpan/wukong-robot">悟空机器人</a></div>
<div class="card-stars">7.1K stars</div>
<div class="card-desc">中文语音对话机器人/智能音箱,支持树莓派部署,内置 FunASR 语音识别引擎。</div>
<div><span class="card-tag">IoT</span><span class="card-tag">助手</span></div>
</div>
<div class="card">
<div class="card-title"><a href="https://github.com/getpaseo/paseo">Paseo</a></div>
<div class="card-stars">6.9K stars</div>
<div class="card-desc">手机端编程助手,通过 Sherpa ONNX 使用 Paraformer 和 SenseVoice 进行语音识别。</div>
<div><span class="card-tag">编程</span><span class="card-tag">智能体</span></div>
</div>
<div class="card">
<div class="card-title"><a href="https://github.com/Kedreamix/Linly-Talker">Linly-Talker</a></div>
<div class="card-stars">3.3K stars</div>
<div class="card-desc">数字人对话系统,融合 ASR、LLM 和 TTS,实现与虚拟形象自然对话。使用 FunASR 语音识别。</div>
<div><span class="card-tag">数字人</span><span class="card-tag">对话</span></div>
</div>
<div class="card">
<div class="card-title"><a href="https://github.com/harry0703/AudioNotes">AudioNotes</a></div>
<div class="card-stars">2.1K stars</div>
<div class="card-desc">音视频内容提取工具,自动整理为结构化 Markdown 笔记。使用 FunASR 高精度转写。</div>
<div><span class="card-tag">笔记</span><span class="card-tag">效率</span></div>
</div>
<div class="card">
<div class="card-title"><a href="https://github.com/wwbin2017/bailing">百聆</a></div>
<div class="card-stars">1.7K stars</div>
<div class="card-desc">类 GPT-4o 语音聊天机器人,完整 ASR + LLM + TTS 语音对话方案。使用 FunASR 语音识别。</div>
<div><span class="card-tag">语音对话</span><span class="card-tag">GPT-4o</span></div>
</div>
</div>
<h2>AI 平台与框架</h2>
<div class="card-grid">
<div class="card">
<div class="card-title"><a href="https://github.com/RVC-Boss/GPT-SoVITS">GPT-SoVITS</a></div>
<div class="card-stars">58K stars</div>
<div class="card-desc">一分钟语音数据即可训练 TTS。使用 FunASR 进行训练数据标注。</div>
<div><span class="card-tag">TTS</span><span class="card-tag">训练</span></div>
</div>
<div class="card">
<div class="card-title"><a href="https://github.com/mudler/LocalAI">LocalAI</a></div>
<div class="card-stars">33K stars</div>
<div class="card-desc">自托管 OpenAI 替代方案。FunASR 作为语音识别后端(PR 审核中)。</div>
<div><span class="card-tag">LLM</span><span class="card-tag">自托管</span></div>
</div>
<div class="card">
<div class="card-title"><a href="https://github.com/BerriAI/litellm">LiteLLM</a></div>
<div class="card-stars">54.3K stars</div>
<div class="card-desc">OpenAI 兼容 AI Gateway。FunASR / SenseVoice 可通过 <code>custom_openai</code> 作为自托管语音转写端点接入。</div>
<div><span class="card-tag">AI Gateway</span><span class="card-tag">OpenAI 兼容</span></div>
</div>
<div class="card">
<div class="card-title"><a href="https://github.com/pipecat-ai/pipecat">Pipecat</a></div>
<div class="card-stars">12.5K stars</div>
<div class="card-desc">语音与多模态对话 AI 框架。FunASR 作为社区 STT 集成。</div>
<div><span class="card-tag">对话 AI</span></div>
</div>
<div class="card">
<div class="card-title"><a href="https://github.com/open-mmlab/Amphion">Amphion</a></div>
<div class="card-stars">9.8K stars</div>
<div class="card-desc">OpenMMLab 开源音频、音乐和语音生成工具包。使用 FunASR 进行 TTS 评测与数据处理。</div>
<div><span class="card-tag">音频工具</span><span class="card-tag">OpenMMLab</span></div>
</div>
<div class="card">
<div class="card-title"><a href="https://marketplace.dify.ai/plugin/langgenius/funasr">Dify · FunASR 官方插件</a></div>
<div class="card-stars">150K stars · 352 installs</div>
<div class="card-desc">FunASR 官方插件 0.1.1 已上线 Dify Marketplace,内置 SenseVoice、Fun-ASR-Nano 与 Paraformer,支持最大 25 MB 音频上传。</div>
<div><span class="card-tag">官方插件</span><span class="card-tag">语音转写</span></div>
</div>
<div class="card">
<div class="card-title"><a href="https://github.com/xorbitsai/inference">Xinference</a></div>
<div class="card-stars">9.3K stars</div>
<div class="card-desc">分布式推理框架。内置 FunASR 语音识别后端,支持一键部署 ASR 模型服务。</div>
<div><span class="card-tag">推理框架</span><span class="card-tag">分布式</span></div>
</div>
<div class="card">
<div class="card-title"><a href="https://github.com/modstart-lib/aigcpanel">AIGCPanel</a></div>
<div class="card-stars">5K stars</div>
<div class="card-desc">一站式 AI 数字人系统,支持视频合成、声音合成与克隆。集成 FunASR 语音识别。</div>
<div><span class="card-tag">数字人</span><span class="card-tag">AIGC</span></div>
</div>
<div class="card">
<div class="card-title"><a href="https://github.com/jingyaogong/minimind-o">MiniMind-O</a></div>
<div class="card-stars">1.6K stars</div>
<div class="card-desc">轻量级多模态模型,融合视觉、音频和语言理解能力。使用 FunASR 作为语音识别模块。</div>
<div><span class="card-tag">多模态</span><span class="card-tag">LLM</span></div>
</div>
<div class="card">
<div class="card-title"><a href="https://github.com/SpenserCai/ComfyUI-FunAudioLLM">ComfyUI-FunAudioLLM</a></div>
<div class="card-stars">95 stars</div>
<div class="card-desc">ComfyUI 自定义节点,集成 SenseVoice 和 CosyVoice。可视化搭建语音识别与合成工作流。</div>
<div><span class="card-tag">ComfyUI</span><span class="card-tag">工作流</span></div>
</div>
</div>
<h2>SenseVoice 社区扩展</h2>
<div class="card-grid">
<div class="card">
<div class="card-title"><a href="https://github.com/lifeiteng/OmniSenseVoice">OmniSenseVoice</a></div>
<div class="card-stars">894 stars</div>
<div class="card-desc">增强版 SenseVoice,支持高精度单词级时间戳输出。速度与原版一致。</div>
<div><span class="card-tag">时间戳</span><span class="card-tag">SenseVoice</span></div>
</div>
<div class="card">
<div class="card-title"><a href="https://github.com/0x5446/api4sensevoice">api4sensevoice</a></div>
<div class="card-stars">541 stars</div>
<div class="card-desc">SenseVoice API 和 WebSocket 服务器。支持 VAD 检测、实时流式识别和说话人验证。</div>
<div><span class="card-tag">API</span><span class="card-tag">WebSocket</span></div>
</div>
<div class="card">
<div class="card-title"><a href="https://github.com/pengzhendong/streaming-sensevoice">streaming-sensevoice</a></div>
<div class="card-stars">451 stars</div>
<div class="card-desc">伪流式 SenseVoice 实现,支持热词增强。实现低延迟准实时语音识别。</div>
<div><span class="card-tag">流式</span><span class="card-tag">热词</span></div>
</div>
<div class="card">
<div class="card-title"><a href="https://github.com/lovemefan/SenseVoice-python">SenseVoice-python</a></div>
<div class="card-stars">111 stars</div>
<div class="card-desc">基于 ONNX Runtime 的 SenseVoice 推理库。企业级部署方案,无需 PyTorch 依赖。</div>
<div><span class="card-tag">ONNX</span><span class="card-tag">部署</span></div>
</div>
<div class="card">
<div class="card-title"><a href="https://github.com/HG-ha/SenseVoice-Api">SenseVoice-Api</a></div>
<div class="card-stars">109 stars</div>
<div class="card-desc">SenseVoice 的 FastAPI 封装,ONNX 推理,体积更小。附带量化模型,支持 GPU 加速。</div>
<div><span class="card-tag">FastAPI</span><span class="card-tag">量化</span></div>
</div>
<div class="card">
<div class="card-title"><a href="https://github.com/LuckLittleBoy/SenseVoice-OneApi">SenseVoice-OneApi</a></div>
<div class="card-stars">93 stars</div>
<div class="card-desc">SenseVoice API 服务,可无缝对接 OneAPI。统一接口管理多个语音识别模型。</div>
<div><span class="card-tag">OneAPI</span><span class="card-tag">API</span></div>
</div>
</div>
<h2>跨平台推理</h2>
<div class="card-grid">
<div class="card">
<div class="card-title"><a href="https://github.com/k2-fsa/sherpa-onnx">Sherpa-ONNX</a></div>
<div class="card-stars">5K+ stars</div>
<div class="card-desc">跨平台语音处理框架。可在 iOS、Android、树莓派、浏览器上运行 SenseVoice 和 Paraformer。</div>
<div><span class="card-tag">移动端</span><span class="card-tag">边缘计算</span></div>
</div>
<div class="card">
<div class="card-title"><a href="https://github.com/RapidAI/RapidASR">RapidASR</a></div>
<div class="card-stars">608 stars</div>
<div class="card-desc">跨平台 ASR 推理库,基于 ONNX Runtime 和 FunASR。开箱即用,支持中英文混合识别。</div>
<div><span class="card-tag">ONNX</span><span class="card-tag">跨平台</span></div>
</div>
<div class="card">
<div class="card-title"><a href="https://github.com/lovemefan/SenseVoice.cpp">SenseVoice.cpp</a></div>
<div class="card-stars">550 stars</div>
<div class="card-desc">SenseVoice 模型的 C/C++ 实现。无需 Python 依赖,纯 C++ 推理。</div>
<div><span class="card-tag">C++</span><span class="card-tag">嵌入式</span></div>
</div>
<div class="card">
<div class="card-title"><a href="https://github.com/huggingface/transformers">Transformers</a></div>
<div class="card-stars">142K stars</div>
<div class="card-desc">Hugging Face Transformers 库。Fun-ASR-Nano 集成(PR 审核中)。</div>
<div><span class="card-tag">ML 框架</span></div>
</div>
<div class="card">
<div class="card-title"><a href="https://github.com/gpustack/vox-box">Vox-Box</a></div>
<div class="card-stars">211 stars</div>
<div class="card-desc">OpenAI 兼容的语音服务器,支持 FunASR、Whisper、Bark、CosyVoice 后端。</div>
<div><span class="card-tag">API 服务</span><span class="card-tag">OpenAI 兼容</span></div>
</div>
<div class="card">
<div class="card-title"><a href="https://github.com/zaigie/FunSpeech">FunSpeech</a></div>
<div class="card-stars">136 stars</div>
<div class="card-desc">开箱即用的本地私有化语音服务。微服务架构,兼容阿里云语音 API 与 OpenAI TTS API,集成 FunASR 和 CosyVoice。</div>
<div><span class="card-tag">API 服务</span><span class="card-tag">私有部署</span></div>
</div>
<div class="card">
<div class="card-title"><a href="https://github.com/huaxin0/FunASR-GGML">FunASR-GGML</a></div>
<div class="card-stars">113 stars</div>
<div class="card-desc">基于 GGML 的 C++ 推理引擎。支持 CPU/CUDA,实时麦克风流式识别,单 GGUF 文件部署。</div>
<div><span class="card-tag">GGML</span><span class="card-tag">C++</span></div>
</div>
<div class="card">
<div class="card-title"><a href="https://github.com/manyeyes/ManySpeech">ManySpeech</a></div>
<div class="card-stars">79 stars</div>
<div class="card-desc">多模型 ASR 推理方案,支持 Paraformer、SenseVoice、Whisper 等。ONNX 推理,适配多场景。</div>
<div><span class="card-tag">多模型</span><span class="card-tag">ONNX</span></div>
</div>
</div>
<h2>快速上手</h2>
<pre>pip install funasr
# Python API
from funasr import AutoModel
model = AutoModel(model="iic/SenseVoiceSmall")
result = model.generate(input="audio.wav")
# 或启动 OpenAI 兼容 API 服务
pip install vllm fastapi uvicorn python-multipart
funasr-server --device cuda</pre>
<div class="cta">
<p>使用 FunASR 构建了项目?欢迎提交到此列表。</p>
<a class="btn" href="https://github.com/modelscope/FunASR">GitHub</a>
<a class="btn outline" href="https://github.com/modelscope/FunASR/issues">提交 Issue</a>
</div>
</div>
</article>
<footer><div class="container">FunASR — 工业级语音识别工具包 — <a href="https://github.com/modelscope/FunASR">GitHub</a> · <a href="./">首页</a> · <a href="https://www.funasr.com">funasr.com</a></div></footer>
</body>
</html>