2026-05-29 10:37
速度翻倍!阶跃星辰开源 Step 3.7 Flash 大模型
文本核心速览
- 模型发布与开源—阶跃星辰发布并开源新一代Step 3.7 Flash模型,专为智能体生产化落地设计,标志着国内大模型赛道新突破。
- 架构与生成速度—采用196B参数稀疏混合专家架构,最高生成速度达每秒400 Tokens,大幅减少多轮对话等待延迟。
- 原生多模态理解—模型可直接识别UI界面、图表和文档等视觉信息,转化为结构化数据或执行代码,提升复杂场景处理能力。
- 联网搜索与工具调用—增强联网检索与图像搜索,主动获取跨文本图像证据;高稳定工具调用支持API、浏览器、终端等,降低开发门槛。
196B参数模型生成速度飙到400 Tokens/s,阶跃星辰开源Step 3.7 Flash专堵Agent延迟
阶跃星辰今天丢出了Step 3.7 Flash模型,开源,196B总参数量,最高生成速度每秒400 Tokens。群里在传这玩意专为智能体(Agent)的生产化落地设计,针对代码编写、联网搜索和多模态工作流做了系统级优化。
核心参数
- 采用稀疏混合专家(MoE)架构,总参数量196B——说白了就是比普通稠密模型更省算力,但能力没缩水。
- 最高生成速度每秒400 Tokens,有开发者试了说多轮对话里基本感觉不到等待延迟,高频交互时体验很顺。
多模态能力
Step 3.7 Flash具备原生多模态理解能力,能直接识别并解析UI界面、图表和文档这类复杂视觉信息。群里有人测了说,它能快速把视觉内容转成结构化数据,甚至直接生成对应的执行代码,比如截个表格图就能自动写出一段提取数据的脚本。
联网检索和图像搜索也加强了。模型可以在开放网络里主动抓取跨文本和图像的多源证据,然后交叉比对,保证拿回来的信息准确——不是瞎编的那种。
工具调用
在长链路、多轮次的智能体工作流里,工具调用稳定性很高。有开发者说它能顺畅驱动API、浏览器、终端和Office工具,任务执行失败或跑偏的概率明显降低。以前Agent经常卡在中间某一步,这个模型看起来稳得多。
生态兼容
Step 3.7 Flash对目前主流的智能体开发框架和工具调用协议做了深度兼容优化。这直接让开发者的接入门槛降了一大截,工作流编排和生态部署变得高效。有开发者评论说:“以前接一个框架要改半天协议,现在基本开箱即用。”
接下来盯着看这个模型在真实Agent落地场景中会不会翻车——比如复杂多模态任务里的幻觉率。传统的慢速模型厂商和闭源收费方案可能要难受了。
来源: aibase阅读原文