返回新闻列表
2026-09-01 17:20
AI123

上海交大等联合团队发布AI自进化工业Coding模型iCoder-27B

上海交通大学人工智能学院、深势科技、无尽前沿与新加坡国立大学联合团队发布了一款由Agent主导开发的工业Coding模型iCoder-27B。该模型在RTLLM、VerilogEval等工业Coding基准上超越同尺寸的Qwen3.6-27B,进入前沿模型竞争区。

据介绍,团队让Agent参与模型开发的完整流程,包括数据演化、SFT冷启动、同策略自蒸馏和可验证奖励强化学习(RLVR)。Agent负责选择实验、诊断失败并反复修改训练策略,人类专家则提供目标、权限边界、训练SOP与可信验证器。评测数据显示,iCoder-27B的RTLLM得分从49.6提升至68.0,VerilogEval Spec-to-RTL从70.1提升至86.3,KernelBench L2正确任务数从28增至74,约为原来的2.64倍。在部分复杂RTL任务上,iCoder仍落后于一些闭源模型,但已在芯片RTL与GPU Kernel两条技术栈上展现出竞争力。

此次实验将前沿模型开发视为长链路压力测试。Agent在训练过程中多次遭遇数据分布偏差、奖励漏洞和基础设施故障等问题,并通过调整训练目标、引入哨兵值和修改轨迹预算等方式修复流程。团队表示,iCoder的意义在于让AI不仅写出更好的代码,也开始参与制造下一代模型。

来源
  1. 2026-09-01 17:03 | 新浪财经:AI到底能不能自己造AI?别吵了,有人做出来了
    阅读原文

    RSI,可能是 AI 世界里最像科幻的一个词。在最强的版本里,你只需要对一套系统说一句 “做一个更好的自己”,它就能提出新想法、搭建训练流程、验证结果,最终交付一个能力更强的继任者。随后,新模型再次重复这个过程,智能由此进入自我加速的循环。这个图景还没有成为现实。但过去几个月,围绕递归自我改进(Recursive Self-Improvement,RSI)的讨论,已经从 “会不会发生” 转向一个更具体的问题:今天的 AI,究竟已经接管了 AI 研发循环中的哪些部分?Anthropic 联合创始人 Jack Clark 在今年 5 月给出过一个激进判断:到 2028 年底,无人参与的 AI 研发...

其他新闻

查看全部