返回新闻列表
2026-09-09 15:37
AI123

新论文揭示大模型行为兼容性:Kimi K3预埋Claude推理前缀后现风格漂移

9月9日,前Google DeepMind研究员舒迈洛夫(Ilia Shumailov)等8人发表论文,披露了一项关于大模型行为兼容性的实验结果。研究团队在成功恢复Anthropic等公司大模型隐藏的推理轨迹后,将Claude Opus 4.8推理轨迹的开头预埋入月之暗面Kimi K3等模型的推理区域,观察模型后续生成的答案是否因此改变。

实验显示,在预埋Opus推理前缀后,K3在29道题上的答案出现明显的Opus风格漂移。其中STEM题平均指标从0.160升至0.305,非STEM题由0.203升至0.289。作为对照的美国开源模型Inkling未出现同等显著变化,而将K3预埋Inkling推理开头也未产生相同程度的效果。此外,在仅预埋两个Token的测试中,K3生成答案与Opus答案的总重合度从0.21升至0.37。

研究人员在附录中强调,这些测试规模较小、题目集中于特定基准,且被恢复的推理轨迹本身来自模糊解码,未必与闭源模型真实内部推理逐字一致。实验只能说明K3在特定干预下对Opus表现出“不寻常的行为兼容性”,无法据此建立“复刻”或“蒸馏”的因果关系。

该论文的发现也再次引发外界对月之暗面与Anthropic之间争议的关注。2026年2月,Anthropic曾公开指控包括月之暗面在内的三家公司存在所谓“大规模蒸馏行为”。月之暗面则在2026年7月发布Kimi K3时否认相关说法,表示其性能跃升来自底层原创架构创新。目前,月之暗面尚未对该论文结果作出回应。

来源
  1. 2026-09-09 14:11 | 新浪财经:新论文揭奇怪现象,2个词元能让Kimi K3变Claude?
    阅读原文

    (文/连政 编辑/吕栋)近日,前Google DeepMind研究员舒迈洛夫(Ilia Shumailov)等8人发表的论文,将月之暗面Kimi K3所谓“蒸馏Claude”的说法,再次拉回人们的视线。目前市面上的许多闭源模型为了维持技术壁垒,均对外隐藏了推理轨迹,因此论文研究人员本意只是寻求如何从Anthropic、OpenAI和Google等公司的大模型API中恢复这些被隐藏的推理轨迹。然而,在成功恢复后,研究人员随手将解码得到Anthropic大模型Claude Opus 4.8推理轨迹的开头部分,预埋入其他几家大模型的推理区域,并让模型自行完成剩余推理和最终答案。结果却显示,K3最后呈...

其他新闻

查看全部