PerfXLab 框架支持哪些国产 AI 芯片?▾
目前已适配寒武纪 MLU、昇腾 NPU、算能 SG6/BM1684、海光 DCU、燧原 GCU 等主流国产芯片,并提供统一的推理 API 接口,开发者无需针对每款芯片重写代码。
PerfXLab 与 NVIDIA TensorRT 相比有什么优势?▾
PerfXLab 针对国产芯片做了算子深度优化,在相同硬件上推理延迟比通用框架低 20%-40%,且支持自动混合精度量化、动态 Shape 推理等特性,无须依赖 CUDA 生态。
主要适用哪些边缘 AI 场景?▾
广泛应用于工业质检、智能摄像头、机器人、边缘服务器、智慧交通等场景,单设备算力从 2 TOPS 到 128 TOPS 的边缘盒均可部署,支持 INT4/INT8 量化以压缩模型体积。
部署方式有哪些?是否支持容器化?▾
提供 C/C++ SDK、Python API 及 Docker 镜像三种部署形态,支持 ARM/x86 边缘主机、Jetson 类模组以及 RK3588、SG2000 等 SoC 板卡,可通过交叉编译一键生成目标平台产物。
商业模式和定价是怎样的?▾
框架本体对开发者免费开源(GitHub 可下载),商业版 PerfXCloud 平台按节点授权或调用量计费,企业级技术支持、定制算子开发和模型压缩服务另行报价,起步约 3 万元/年。