返回新闻列表
2026-07-30 10:22

Kimi K3开源与摩尔线程智算卡完成全栈适配

文本核心速览
  1. Kimi K3开源发布月之暗面开源2.8万亿参数大模型Kimi K3,拥有100万token上下文窗口,原生支持视觉理解,为全球首个开源3万亿级别模型。
  2. 核心架构创新Kimi K3采用KDA混合线性注意力、注意力残差、Gated MLA及Stable LatentMoE等设计,专为长程编程与复杂推理优化。
  3. 摩尔线程全栈适配摩尔线程基于MTT S5000智算卡与MUSA软件栈,在数小时内完成Kimi K3的极速适配与稳定拉起,验证国产GPU支撑万亿级模型能力。
  4. 产业协同意义此次适配标志国产算力生态已具备承接万亿参数大模型能力,推动AI产业向自主可控软硬件全栈创新迈进。

Kimi K3开源与摩尔线程智算卡完成全栈适配

7月28日晚,月之暗面正式开源了其2.8万亿参数模型——Kimi K3,并同步发布了模型权重与技术报告。同日,摩尔线程官微宣布,基于其AI训推一体智算卡MTT S5000及MUSA软件栈,率先完成Kimi K3的极速适配与稳定拉起。

Kimi K3:全球首个开源的3万亿级别大模型

Kimi K3作为月之暗面目前能力最强的版本,拥有2.8万亿参数与100万token上下文窗口,原生支持视觉理解。其架构融合了多项创新:

  • KDA混合线性注意力机制(Kimi Delta Attention):优化长序列处理效率。
  • 注意力残差(Attention Residuals):提升训练稳定性。
  • Gated MLA:改进多头注意力机制。
  • Stable LatentMoE:实现稀疏激活与稳定训练。

这些设计专为长程编程、知识工作与复杂推理等前沿智能场景打造,使得Kimi K3在多项基准测试中表现优异。

摩尔线程全栈适配:国产算力协同

摩尔线程基于其AI训推一体智算卡MTT S5000及MUSA软件栈,成功完成了Kimi K3的极速适配与稳定拉起。此次适配不仅展现了摩尔线程MUSA软件生态面向前沿超大规模模型的快速响应能力,也验证了国产全功能GPU支撑万亿级大模型研发与工程落地的硬核实力。

适配技术亮点

  • 极速适配:从模型发布到适配完成仅用数小时,体现了国产算力生态的高效协同。
  • 稳定拉起:在MTT S5000上成功运行Kimi K3的推理任务,验证了硬件与软件栈的兼容性。
  • 全栈协同:MUSA软件栈提供了完整的模型加载、算子优化与内存管理支持。

产业意义:迈向自主可控的AI基础设施

随着高性能国产算力与顶尖开源生态的深度协同,大模型产业正加速迈向高效、自主可控的软硬件全栈创新阶段。Kimi K3与摩尔线程智算卡的适配,标志着国产GPU生态已具备承接万亿参数大模型的能力,为AI应用的自主可控奠定了坚实基础。

未来,这种协同将推动更多国产模型与硬件适配,降低对海外算力的依赖,促进国内AI技术的独立发展。

来源: aibase阅读原文

其他新闻

查看全部