代季峰团队发布首款开源大模型Naive-N0.5-Flash
9月28日,代季峰创业团队Naive AI发布首款开源模型Naive-N0.5-Flash。该模型总参数量为309B,激活参数量15.5B,原生支持百万token上下文,面向编程与AI研发场景。
Naive AI成立于2026年2月,自成立起便尝试由AI模型承担代码编写、实验运行、流程监控、结果分析等研发工作,人类研究员专注于设定目标、约束与评价标准,并负责最终决策。技术报告显示,AI已参与注意力架构的探索,以及训练、推理和部署系统的优化。
研发案例方面,研究员与AI在六天内推进151轮优化实验,将推理运行时NaiveRT单轮完整投机解码耗时从12.3毫秒降至3.4毫秒;在世界模型研究中,Naive-N0.5-Flash经400小时、15轮主要实验得到AutoWM,在WorldArena-1 Track 1视频质量评测中得分77.43,高于当时公开最高成绩。评测方面,该模型在PaperBench取得63.2分,在MLE-bench-30取得73.7%。
Naive-N0.5-Flash以开放权重模型MiMo-V2.5 base为起点,采用SWA与DeepSeek稀疏注意力(DSA)混合架构。模型权重与推理代码采用MIT许可,并将提供API。Naive AI表示,这类实践是其探索递归式自我改进(RSI)路线的一部分。
- 2026-09-28 02:06 | 36氪:用AI造的,刚刚,代季峰团队首个模型开源阅读原文
Naive AI 正在探索一条令人兴奋的新路径:让当前的 AI 模型去承担下一代模型的研发工作,并且让每一代诞生的模型都能够比上一代承担更多的研发工作。 10 天前,Anthropic 公布了一组少见的内部数据:公司内部的 AI 研发工作中,已有 26% 由 Claude「主导」完成。所谓主导,是指研究员只需给出一条高层指令,Claude 就能端到端地完成任务的大部分,人类负责监督。而在今年 2 月,这个比例还不到 1%。 而这并不是一个孤立事件。更早几天,OpenAI 宣布去年定下的「自动化研究实习生」目标已经达成:按标准工作日折算,其研究团队每投入 1 个人类工作日,就有约 ...