龙芯中科发布自研GPU加速计算平台首个软件版本
2026年9月22日,龙芯中科宣布推出支持自研通用GPU的龙芯加速计算平台(Loongson Accelerated Computing Platform)首个软件版本,面向龙芯通用GPU提供从底层驱动、编程环境到AI模型推理的完整软件支持。
该平台基于龙芯2K3000和9A1000芯片集成的LG200系列通用GPU核心开发,在已有OpenGL、Vulkan图形软件栈的基础上,进一步覆盖算力芯片驱动、编译器、运行时环境、算子库、推理引擎、调试工具和性能分析工具等组件。平台支持OpenCL 3.0和CUDA两类编程模型接口,并集成BLAS、DNN等高性能算子库,可用于AI模型推理。
运行时环境方面,平台提供资源调度管理、内存管理、任务队列调度和事件同步等功能。底层驱动对硬件计算资源进行统一抽象和管理,以支持多进程、多任务并发执行。平台集成的算力编译器兼容OpenCL 3.0和CUDA接口,并针对自研通用GPU的指令集架构和硬件特性进行了优化,通过API层面兼容降低开发与迁移适配成本。
AI推理方面,龙芯中科推出高性能推理引擎LacInfer,通过算子融合、常量折叠、算子消除和布局转换等方式优化计算图。平台支持ONNX Runtime,并将LacInfer作为执行后端,用户可将PyTorch、TensorFlow等框架导出的ONNX模型直接部署到龙芯通用GPU平台,无需额外转换或重写代码。目前,龙芯中科已在9A1000等芯片上针对目标检测、图像分割、姿态估计等计算机视觉模型进行优化。
硬件兼容方面,平台支持龙芯全系列算力芯片和Linux多内核版本系统,并计划随着9A2000、9A3000等后续算力芯片推进同步演进。龙芯中科表示,相关算力软件已服务部分早期客户,并基于2K3000、9A1000开展多款具身智能设备的智能体研发。
- 2026-09-22 11:05 | IT之家:龙芯发布自研通用 GPU 加速计算平台首个软件版本:支持 OpenCL 3.0、CUDA 及 AI 推理阅读原文
IT之家 9 月 22 日消息,龙芯中科今日宣布推出支持自研通用 GPU 的龙芯加速计算平台(Loongson Accelerated Computing Platform)首个软件版本,面向龙芯通用 GPU 提供从底层驱动、编程环境到 AI 模型推理的完整软件支持。该平台基于龙芯 2K3000 和 9A1000 芯片集成的 LG200 系列通用 GPU 核心开发。在已有 OpenGL、Vulkan 图形软件栈的基础上,平台进一步覆盖算力芯片驱动、编译器、运行时环境、算子库、推理引擎、调试工具和性能分析工具等组件。龙芯加速计算平台支持 OpenCL 3.0 和 CUDA 两类编程模型接口,并集...