Downloads · 30 days
24
4% of all-time downloads
AXERA-TECH/FireRedASR-AED
FireRedASR-AED is a audio-to-audio model from AXERA-TECH. Use it for the audio-to-audio task on the model card, and read the license before you ship it in a product. The card lists the license as apache-2.0.
小红书 ASR AED-L 在 AX650N 上的 NPU 部署(原项目: FireRedTeam/FireRedASR)。 支持中文、英文,最长 10s 输入,超长音频自动 VAD 切分。
Downloads · 30 days
24
4% of all-time downloads
All-time downloads
563
Public
Repo size
2.6 GB
Likes
0
Public
Click a slice to open those files.
.axmodel1.3 GB · 98%
From the Hugging Face model README
小红书 ASR AED-L 在 AX650N 上的 NPU 部署(原项目: FireRedTeam/FireRedASR)。 支持中文、英文,最长 10s 输入,超长音频自动 VAD 切分。
| 文件 | 说明 |
|---|---|
axmodel/encoder.axmodel / axmodel/decoder_loop.axmodel | Pulsar2 7.0-lite 重转换(encoder U16 + decoder U8 密集校准) |
fsmn_vad/fsmn_vad_10s_fp32.axmodel + fsmn_vad/am.mvn | FSMN-VAD(FunASR)NPU 语音门控 |
conda create -n fireredasr python=3.12
conda activate fireredasr
pip install -r requirements.txt
pip install axengine-0.1.3-py3-none-any.whl # pyaxengine
python openai/openai_server.py \
--encoder axmodel/encoder.axmodel \
--decoder axmodel/decoder_loop.axmodel \
--fsmn-vad fsmn_vad/fsmn_vad_10s_fp32.axmodel \
--fsmn-cmvn fsmn_vad/am.mvn \
--cmvn axmodel/cmvn.ark --dict axmodel/dict.txt \
--pe axmodel/pe.npy --max-dur 10 --max-steps 128
cpp/bin/firered_openai_server、cpp/bin/firered_openai_client
(用法见 cpp/bin/README.md)openai/openai_server.py、openai/openai_client.py(stdlib,零额外依赖)openai/firered_asr.py + openai/fsmn_vad_post.py
(numpy + pyaxengine + kaldi-native-fbank,无 torch/onnxruntime)POST /v1/audio/transcriptions(multipart file)、GET /v1/models7.0 重转换、C++ SDK 源码与构建说明见
GitHub(cpp/、reports/)。