龙芯中科发布软件版通用GPU加速计算平台

来源:爱集微 #龙芯中科#
832

9月22日,龙芯中科宣布,正式推出自研通用GPU对应的龙芯加速计算平台首个软件版本。该平台可为龙芯自研通用GPU提供底层驱动、编程环境至AI模型推理的全链条软件支撑,搭建适配智能应用的算力软件体系。

该平台依托龙芯2K3000与9A1000芯片集成的LG200系列通用GPU核心开发。在原有图形软件栈基础上,平台新增算力驱动、编译器、算子库、推理引擎、调试与性能分析工具等组件。底层驱动统一管理硬件资源,支持多进程、多任务并发,运行时环境承担资源调度、内存管理与任务队列调度工作。

开发层面,该加速计算平台同时兼容OpenCL 3.0与CUDA两类编程模型接口,内置BLAS、DNN高性能算子库。平台编译器针对自研GPU指令集和硬件特性完成优化,依托API兼容能力降低应用迁移成本,基于CUDA开发的AI程序可以低成本向龙芯平台迁移。

在AI推理环节,龙芯中科配套推出高性能推理引擎LacInfer,通过算子融合、常量折叠等手段优化计算图。该引擎可作为ONNX Runtime后端,PyTorch、TensorFlow框架导出的ONNX模型能够直接部署。目前企业已在9A1000芯片上完成目标检测、图像分割等计算机视觉模型适配优化。

该平台支持龙芯全系列算力芯片以及多个Linux内核版本,后续将伴随9A2000、9A3000等新品同步迭代,保障不同代际芯片软件兼容。相关算力软件已向部分早期客户交付,并依托2K3000、9A1000开展多款具身智能设备的智能体研发。

(校对/李正操)

责编: 李正操
来源:爱集微 #龙芯中科#
THE END

*此内容为集微网原创,著作权归集微网所有,爱集微,爱原创

关闭
加载

PDF 加载中...