3. 此芯P1端侧AI

此芯P1提供强大的CPU/GPU/NPU异构计算,综合AI算力可达45 TOPS,能满足不同场景的AI算法需求。基于Linux的推理框架和硬件加速方式推荐如下:

模型类别 框架 硬件加速 备注
LLM llama.cpp CPU – KleidiAI
GPU – Vulkan
支持Qwen, MiniCPM, Ernie等大语言模型
MNN CPU – KleidiAI
GPU – OpenCL
CV CIX NOE NPU 支持Yolo, ResNet, MobileNet, OCR, Embedding等模型
Audio CIX NOE NPU 支持ASR, TTS等模型
SD CIX NOE NPU 支持SD 1.4, SDXL等模型
VLM CIX NOE + llama.cpp/MNN NPU + CPU/GPU Embedding & ViT部分可以用NPU加速,LLM部分可以用CPU/GPU加速

此芯AI Model Hub提供适配优化好的主流模型下载,开发者可以直接部署使用。

点击此处获取CIX AI ModelHub