2026-10-02 19:15
AI123

StartLux发布开源决策模型StartLux-Decision,五档版本覆盖0.8B至27B

10月2日,上海人工智能企业StartLux(原点星辉)正式发布专用决策模型StartLux-Decision,并同步开放代码与模型权重。首批提供0.8B、2B、4B、9B、27B五个参数版本,面向智能体执行任务中的重复判断场景。

据介绍,该模型接收当前状态与候选项,支持选择题、是非题和等级评分,一次前向计算即可返回多个问题的判断及选项概率,无需逐字生成回答。例如同一条客服工单可同时判断应交给哪个团队、是否需要当天处理及影响程度。

在独立评测Decision Index 0.2.1中,StartLux-Decision-27B得分63.88,高于Jev 1.13的57.91,38项基准中有31项得分更高。参照上海人工智能实验室Intern-Decision评测组合,27B版本平均准确率91.82%,高于Jev的88.74%和Intern-Decision-4B的90.02%。性能方面,4B版本在单张H200、BF16精度下回答三个问题平均耗时26毫秒。

StartLux表示,该模型研发与验证全程仅用3天,依托公司正在建设的Auto Research方法。这套方法属于其RSI(递归式自我改进)体系,让AI参与“假设—实验—验证—新假设”循环,分析失败、构造数据、执行训练与评测,而研究目标与关键取舍仍由人类研究员把关。

目前,StartLux已公开模型权重、相关代码及评测结果。公司计划让决策模型与通用模型、智能体及运行时等模块协同,服务本地智能解决方案。

来源
  1. 2026-10-02 18:22 | 新浪财经:AI参与“造AI”? StartLux 3天完成决策模型研发与验证
    阅读原文

    近日,上海人工智能企业StartLux(原点星辉)发布专用决策模型StartLux-Decision,并开放代码与模型权重。据团队介绍,完成StartLux-Decision的研发与验证全程仅用3天,支撑这一速度的,是该公司正在建设的Auto Research方法。本次首批推出0.8B、2B、4B、9B、27B五档版本。38项基准中31项超越Jev在StartLux公布的测评数据显示,在独立的DecisionIndex 0.2.1评测中,StartLux-Decision-27B得分63.88,高于Jev 1.13的57.91;在38项基准中,有31项得分更高。对照采用2026年9月28日的公...

其他新闻

查看全部