6.3. Audio 类算法#

本页列出已在爱芯 NPU 平台完成适配的语音/音频模型。所有模型可通过 AXERA 模型仓库(Hugging Face | ModelScope)下载预编译 axmodel。

运行示例与上板命令见 示例展示

6.3.1. ASR(语音识别)#

6.3.2. 说话人识别 / 会议转录#

6.3.3. TTS(语音合成)#

6.3.4. VAD / 降噪#

6.3.5. Embedding / 翻译#