Kimi K3 模型预热视频流出,多段对比直指Claude Fable5 发起挑战
- 预热视频暗示K3—月之暗面7月15日发布预热视频,视频约4秒处出现数字"3",外界解读为对Kimi K3的明确暗示,新品有望近期推出。
- 匿名模型对比测试流出—代号Kivine的匿名模型现身Arena.ai,疑为Kimi K3。网友晒出多段与Claude Fable5及GPT-5.6 Sol的对比测试视频,直指编程能力旗舰。
- K2系列快速迭代—Kimi K2为开源MoE架构模型,K2.6于2026年4月发布,支持最多300个子Agent并行处理任务,旧版API将于5月25日下线。
匿名模型 Kivine 就是 Kimi K3,对比测试直指 Claude Fable5 和 GPT-5.6 Sol
7 月 15 日,月之暗面在 B 站、X 平台和小红书发了一段预热视频,视频第 4 秒闪过的数字“3”暗示 Kimi K3 即将推出;同一时期,匿名模型 Kivine 出现在 Arena.ai 评测平台,群里在传这就是 K3。
匿名现身 Arena.ai
代号 Kivine 的匿名模型已悄然出现在 Arena.ai 上,Arena.ai 是一个第三方大模型竞技场。有开发者试了说,该模型在对比测试中表现激进——已有网友晒出多段 Kimi K3 与 Claude Fable5 的对比视频,还有和 GPT-5.6 Sol 的横向测试,结果显示月之暗面这次直接瞄准了当前编程能力最强的旗舰模型。
对比测试直指旗舰
视频和测试数据里,Kimi K3 在代码生成、长程任务执行上跟 Fable5 和 Sol 打得有来有回。一位在 X 上贴出测试结果的用户吐槽:“这模型处理复杂 Agent 场景时,跟 Sol 的差距在肉眼可见地缩小。” 群里也在传,月之暗面这次压根没留手,把对标对象直接从自家 K2 系列跳到了海外顶流。
K2 系列快速迭代
回顾之前:2025 年 7 月发布的 Kimi K2 是开源 MoE 架构模型,总参数 1T(一万亿)、激活参数 32B(320 亿),换算一下,激活参数只占 3.2%,典型的稀疏模型——代码能力和通用 Agent 任务当时已算不错(一万亿参数但每次只激活 320 亿,省算力)。 2026 年 4 月,月之暗面发布并开源了 Kimi K2.6,升级核心在三点:代码编写更强、长程任务更稳、Agent 集群能调度最多 300 个子 Agent 并行干活——300 个 Agent 同时跑,等于一个模型带一支“数字外包团队”(相当于同时指挥 300 个小助手干活)。 K2.6 发布不久,月之暗面就通知旧版 API 将于 5 月 25 日 下线,逼用户转向最新模型(给用户不到两个月迁移)。从 K2 到 K2.6 只隔了 9 个月,迭代速度极快。
正面叫板海外旗舰
现在 K3 直接对标 Claude Fable5 和 GPT-5.6 Sol,说明国产大模型在编程与 Agent 赛道上不再只是追赶,而是要正面叫板。接下来盯着看 K3 会不会开源、能否在 Arena.ai 的排行榜上压过 Fable5 和 Sol。这会让 DeepSeek、阿里通义等国产厂商感到压力,也让 Anthropic 和 OpenAI 得重新评估这个对手的威胁。