2026-10-08 18:55
AI123

智谱唐杰披露下一代大模型GLM-5.4/5.5规划:参数破万亿,探索RSI自主迭代路径

10月8日,智谱创始人唐杰在新加坡的一场演讲中披露了下一代大模型GLM-5.4/5.5的研发方向。他介绍,新一代模型将在预训练数据和规模上大幅提升,目标做到几个T,参数量将从当前7400多亿级别提升至至少1万亿,以进一步提升模型能力上限。

在后训练方面,智谱将继续强化SFT、RLHF、RLVR等强化学习训练。同时,模型将进一步提升长程推理与Agent能力,面向更复杂的环境、更困难的任务和更长的周期,给模型更大的思考和操作空间,向长程任务和自主智能体方向推进。

唐杰表示,GLM-5.4/5.5将走两条新的技术路线:一是RSI(递归自我改进)自主迭代升级,二是更长更自主的Agent。他曾在2026年8月底的财报会议上提出,下一代大模型应是fully self-training(完全自训练),即模型从预训练到中训练、再到后训练都能自己训练自己并实现自我进化。据相关解读,GLM-5.4/5.5不会实现得这么彻底,可能会有部分RSI成果出现,完全自主的RSI进化仍需等待。

来源
  1. 2026-10-08 18:30 | 新浪财经:智谱暗示新一代GLM-5.4/5.5大模型:参数量万亿以上、技术要走2条新路
    阅读原文

    快科技10月8日消息,之前提到国产大模型最近两个月很低调,但这也意味着新一轮爆发就在眼前,其中智谱下一代大模型应该是GLM-5.4或者GLM-5.5,提升会很大。智谱创始人唐杰日前在新加坡的一次演讲中又提到了他们的大模型研发方向,主要涉及3个方面,首先是预训练的数据和规模会扩大,目标是做到几个T,提升智能上限。这个就意味着GLM-5.4/5.5的参数量会从目前7400多亿级别提升到至少1万亿参数量了,通常规模越大意味着知识量和能力上限就更强,必不可少的一部分。在RL后训练方面,智谱被网友称为后训练仙人,实力极强,在GLM-5.4/5.5上也会强化这一部分,加强SFT、RLHF、RLVR等强化学...

其他新闻

查看全部