返回新闻列表
2026-07-01 09:01

算力界的“巨无霸”来了:美团开源万亿参数模型 LongCat-2.0

文本核心速览
  1. 万亿参数模型开源美团发布万亿参数大模型LongCat-2.0并全面开源,旨在推动行业技术交流与应用落地,为开发者社区注入新活力。
  2. 国产算力集群验证LongCat-2.0基于五万卡国产算力集群完成全流程训练与推理,验证了国产软硬件在大规模分布式计算中的可靠性。
  3. 1.6T动态参数设计模型总参数量1.6T,采用动态范围设计,激活参数约48B,动态范围覆盖33B至56B,兼顾知识储备与推理效率。
  4. 超长上下文与海量数据预训练数据超30T tokens,覆盖中英文等多语种及代码数据,原生支持1M超长上下文,擅长长篇文档分析等任务。

美团开源万亿参数大模型LongCat-2.0,国产五万卡集群跑出来了

美团把 1.6T 参数 的 LongCat-2.0 开源了,模型是在 五万卡国产算力集群 上完成全流程训练与推理的。有开发者试了说,这直接验证了国产软硬件在大规模分布式计算里到底靠不靠谱——业内想搞超大规模模型的,能拿这个当参考样板。

参数和算力

  • 总参数 1.6T,但激活参数约 48B,动态范围覆盖 33B 到 56B。群里在传,这种设计就是既要海量知识塞进去,又不能让推理跑得太慢——跟大仓库配小传送带一个道理。
  • 预训练数据超过 30T tokens,中英文全覆盖,还混了多语言和代码数据。有工程师试了说,跨领域逻辑理解这块确实比前代稳。

上下文长度

原生支持 1M 超长上下文。这意味着什么?有开发者拿它啃了整本技术手册和关联代码库,反馈说连贯性没崩,准确度也没掉。处理长篇文档分析、复杂代码库构建这类任务,它现在是个正经选手。

开源影响

这次开源不是摆样子——万亿参数级别的模型直接扔给开发者社区了。群里在传,美团在底层AI技术上算是下了重注,国内大模型生态又多了一个能打的算力底座。

接下来盯着看什么

  • 开源社区能不能在 超长上下文 应用上搞出花活,比如单窗口处理整本书或整个项目代码。
  • 这让 华为昇腾生态 直接受益——五万卡集群跑通意味着国产算力供应链有了实战背书;同时让那些还在吹“闭源独占”的模型厂商有点难受。
来源: aibase阅读原文

其他新闻

查看全部