3. 此芯P1端侧AI
此芯P1提供强大的CPU/GPU/NPU异构计算,综合AI算力可达45 TOPS,能满足不同场景的AI算法需求。基于Linux的推理框架和硬件加速方式推荐如下:
| 模型类别 | 框架 | 硬件加速 | 备注 |
|---|---|---|---|
| LLM | llama.cpp | CPU – KleidiAI GPU – Vulkan |
支持Qwen, MiniCPM, Ernie等大语言模型 |
| MNN | CPU – KleidiAI GPU – OpenCL |
||
| CV | CIX NOE | NPU | 支持Yolo, ResNet, MobileNet, OCR, Embedding等模型 |
| Audio | CIX NOE | NPU | 支持ASR, TTS等模型 |
| SD | CIX NOE | NPU | 支持SD 1.4, SDXL等模型 |
| VLM | CIX NOE + llama.cpp/MNN | NPU + CPU/GPU | Embedding & ViT部分可以用NPU加速,LLM部分可以用CPU/GPU加速 |
此芯AI Model Hub提供适配优化好的主流模型下载,开发者可以直接部署使用。