返回新闻列表
2026-05-27 10:52

阿里 Qwen3.7-Max 编程能力全球登顶第二!Code Arena 1541 分,仅次 Claude,35 小时自主任务刷新生产力上限

文本核心速览
  1. 全球编程排名第二Qwen3.7-Max在Code Arena榜单中以1541分位列全球第二,仅次于Claude系列,超越GPT-5.5、Gemini3.5Flash等模型,成为国产大模型编程新标杆。
  2. 长时程Agent能力模型支持35小时连续自主任务,完成超过1000次工具调用,可将原本2周开发周期压缩至数小时,极大提升生产效率。
  3. 跨框架兼容与性价比Qwen3.7-Max兼容Anthropic协议,可无缝接入Claude Code等工具链,同时成本控制优势显著,为开发者提供高性能与性价比平衡选择。
  4. 生产级效能突破模型在复杂代码生成、调试、多文件工程及工具调用链路中表现强劲,已达到可直接用于生产级项目的水平,推动AI从“助手”向“同事”转型。

Qwen3.7-Max 1541分全球第二,Claude之下碾压GPT-5.5

5月26日,Code Arena榜单出炉,阿里Qwen3.7-Max以1541分拿下全球第二,仅次于Claude系列,把GPT-5.5、Gemini3.5Flash都踩在脚下。这分数啥概念?就是全球能打的模型里排老二,国产里老大,编程领域的新标杆。

编程实力全球第二,国产第一稳了

根据最新Code Arena榜单,Qwen3.7-Max在真实编程场景中综合表现突出,尤其在复杂代码生成、调试、多文件工程以及工具调用链路等方面展现出极强竞争力。群里在传,这排名不光是单步编码能力,更反映实际软件开发流程中的整体效能——已经达到能直接扔进生产级项目用的水平。

35小时长时程Agent,从助手变同事

Qwen3.7-Max最大亮点是它的Agent导向设计,特别擅长长周期自主执行任务:

  • 支持运行35小时连续自主任务
  • 完成超过1000次工具调用
  • 能把原本需要2周开发周期的项目压缩至数小时内完成

有开发者试了说,这货在复杂内核优化、长时间多步推理等真实场景中表现出色,能持续保持上下文连贯性和纠错能力,极大提升开发者和企业的生产效率。群里在传,这种长时程Agent能力正是当前大模型从“助手”向“同事”转型的关键指标。

跨框架通用性强,性价比优势明显

Qwen3.7-Max支持多种Agent框架,包括兼容Anthropic协议,可无缝接入Claude Code等现有工具链。同时成本控制上也有明显优势,给开发者提供了高性能与高性价比的平衡选择。有开发者试了说,随着Qwen3.7-Max发布,AI编程工具门槛进一步降低——前端原型开发、复杂后端工程、全栈自动化流程,都将迎来更高效的AI辅助时代。这对国内开发者和全球AI应用落地都是利好。

接下来盯着看什么? 看它能不能在真实生产环境下大规模替代人工开发,尤其那些卖高价API的厂商(比如OpenAI、Anthropic)——Qwen3.7-Max的性价比会让它们很难受。

来源: aibase阅读原文

其他新闻

查看全部