← Open Source
RapidAI

RapidASR

📣 商用级开源语音自动识别程序库,开箱即用,全平台支持,中英文混合识别。A Cross-platform implementation of ASR inference. It's based on ONNXRuntime and FunASR. We provide a set of easier APIs to call ASR models.

AI EngineeringMake agent see hear talkC++
Open on GitHub
Momentum
+0stars in 24 hours0.0%
611
Stars
72
Forks
+-1
This week
4
Contributors
Created 2021-12-15 · Updated 2026-09-30 · #14009 today
Top developers
README

Rapid ASR

[![](https://img.shields.io/badge/%F0%9F%A4%97-Hugging Face Demo-blue)](https://huggingface.co/spaces/SWHL/RapidASRDemo)
[![](https://img.shields.io/badge/ModelScope-Demo-blue)](https://www.modelscope.cn/studios/liekkas/RapidASRDemo/summary)
![](https://img.shields.io/badge/OS-Linux%2C%20Win%2C%20Mac-pink.svg)
![]("https://img.shields.io/badge/Python-) =3.6,<3.13-aff.svg">
![](https://img.shields.io/badge/C++-aff.svg)
  • 🎉 推出知识星球RapidAI私享群,这里的提问会优先得到回答和支持,也会享受到RapidAI组织后续持续优质的服务。欢迎大家的加入。
  • Paraformer模型出自阿里达摩院Paraformer语音识别-中文-通用-16k-离线-large-pytorch。
  • 本仓库仅对模型做了转换,只采用ONNXRuntime推理引擎。该项目核心代码已经并入FunASR。
  • 项目仍会持续更新,欢迎关注。
  • QQ群号:645751008

📖文档导航

📆TODO以及任务认领

  • 参见这里:link

🎨整体框架

flowchart LR

A([wav]) --RapidVad--> B([各个小段的音频]) --RapidASR--> C([识别的文本内容]) --RapidPunc--> D([最终识别内容])

📣更新日志

详情

  • 2023-08-21 v2.0.4 update:
    • 添加whl包支持
    • 更新文档
  • 2023-02-25
    • 添加C++版本推理,使用onnxruntime引擎,预/后处理代码来自: FastASR
  • 2023-02-14 v2.0.3 update:
    • 修复librosa读取wav文件错误
    • 修复fbank与torch下fbank提取结果不一致bug
  • 2023-02-11 v2.0.2 update:
    • 模型和推理代码解耦(rapid_paraformer和resources)
    • 支持批量推理(通过resources/config.yaml中batch_size指定)
    • 增加多种输入方式(Union[str, np.ndarray, List[str]])
  • 2023-02-10 v2.0.1 update:
    • 添加对输入音频为噪音或者静音的文件推理结果捕捉。