返回新闻列表
2026-05-19 10:06

等不及正式版?Qwen3.7 预览模型已可体验!数学/编程/多模态全面进阶,思考模式先睹为快

文章提及的 AI 工具阿里云智能logo设计
文本核心速览
  1. 两款预览模型上线阿里通义千问发布Qwen3.7-Max-Preview和Qwen3.7-Plus-Preview两款预览模型,已在Qwen Chat和Arena AI开放体验,预计5月20日阿里云峰会正式官宣。
  2. 旗舰与均衡双定位Max-Preview为旗舰级,主打综合性能天花板,当前仅开放思考模式;Plus-Preview为高性能均衡版,同样聚焦推理与逻辑表达,工具链待后续开放。
  3. 文本能力排名亮眼在Arena AI文本榜单中,Max-Preview综合排名第13,推动通义千问实验室全球第六;细分赛道:数学推理第7、专家级应用第9、软件IT第9、编程第10。
  4. 视觉与专家任务表现Plus-Preview视觉能力综合排名第16,助力通义千问视觉榜所有实验室第5;在专家竞技场中,Max-Preview拿下第9,高难度任务稳定性逼近第一梯队。
## 阿里通义千问Qwen3.7预览版悄然上线,实测多项能力进入前十 阿里通义千问的 Qwen3.7-Max-Preview 与 Qwen3.7-Plus-Preview 两款预览模型,已经悄悄上架了 Qwen Chat 和 Arena AI,大概率会在5月20日的阿里云峰会上正式官宣。这次放出的两款预览版,定位很清晰:Qwen3.7-Max-Preview 是旗舰级「大脑」预览,主打综合性能天花板,目前仅开放思考模式,搜索、代码解释器等工具能力暂未解锁;Qwen3.7-Plus-Preview 是高性能均衡版预览,同样聚焦推理与逻辑表达,工具链同步待后续开放。 ## 实测表现 虽然还是「预览态」,但已经有开发者在 Arena AI 试了,说结果很亮眼。在 Arena AI 的文本能力榜单中,Qwen3.7-Max-Preview 综合排名第13位——这个排名不算顶尖,但推动阿里通义千问在同类实验室中跻身全球第六,说明模型底子不错。细分赛道上更亮眼:数学推理第7(几乎摸到第一梯队边了)、专家级应用第9、软件与 IT 领域第9、编程能力第10,展现出扎实的多任务泛化实力。视觉能力方面,Qwen3.7-Plus-Preview 综合排名第16,助力通义千问在视觉榜所有实验室中排到第5——第16名在视觉榜里算中上游水平;而在仅面向专家级提示词的「专家竞技场」中,Qwen3.7-Max-Preview 同样拿下第9名,说明其在高难度、高精度任务下的稳定性正在快速逼近第一梯队。 ## 信号与策略 对开发者和重度用户而言,这次预览版上线,既是提前体验下一代模型能力的窗口,也释放了一个信号:阿里云正通过「小步快跑、快速迭代」的策略,在大模型军备赛中持续卡位关键节点。 ## 接下来盯什么 接下来得盯5月20日阿里云峰会会不会放出完整版或开源参数——这让 DeepSeek 等开源阵营难受,也让那些还没追上第一梯队的闭源模型更焦虑。
来源: aibase阅读原文

其他新闻

查看全部