2026-09-22 10:51
AI123

SpaceXAI发布新一代大模型Grok 4.7,编程基准表现大幅提升

9月22日,SpaceXAI正式发布面向编程与专业工作场景的新一代大模型Grok 4.7。该模型在编程、终端操作等基准测试中的表现较上一代Grok 4.6明显提升,并采用了更长时间的强化学习训练和全新的安全防护机制。

据SpaceXAI介绍,Grok 4.7基于比Grok 4.6更大的基础模型,训练中使用了更难的、偏向耗时数小时任务的数据分布,以增强模型在长任务中的稳定性。公司还改善了长上下文管理,并使其更好地配合近期推出的智能体工具Grok Bot。

定价方面,Grok 4.7延续了Grok 4.6的价格,API每百万输入/输出token分别为2美元/6美元。SpaceXAI还推出了处理速度更快的版本,价格为标准版的两倍,即每百万输入/输出token 4美元/12美元,但未公布具体每秒token数。AI编程平台Cursor也提供Grok 4.7的Fast档位,价格同样为4美元/12美元,并在Pro及以上计划中默认启用Fast。

目前,Grok 4.7已在Cursor、Grok Build和Grok API上线,同时可通过第三方编程工具、模型路由器和云平台使用。GitHub正在逐步将Grok 4.7集成到Copilot Pro、Pro+、Max、Business和Enterprise等套餐中,支持VS Code、Visual Studio、Copilot CLI、JetBrains、Xcode和Eclipse等环境。

需要说明的是,独立评测机构Artificial Analysis的测试显示,Grok 4.7在智能指数任务中的输出token消耗约为8.1万,明显高于Grok 4.6的3.6万,按每任务成本计算约为3.74美元。这意味着虽然其API单价未变,实际完成任务的成本可能并不低于部分竞品。SpaceXAI还报告了Grok 4.7新增的安全防护机制,在生物安全基准LatchBio上得分为62.4%,在HackerBench v0.3评估中仅放行3.3%的风险提示,但这些数据尚待独立验证。

来源
  1. 2026-09-22 06:44 | venturebeat.com:Grok 4.7 pairs coding gains with the same affordable pricing — but high token consumption threatens real-world ROI
    阅读原文

    SpaceXAI earlier today released Grok 4.7, its latest model for coding and professional knowledge work, with improved performance on benchmarks (especially coding, or Terminal Bench), a longer reinforcement-learning run and a new safeguard stack aimed at making the system more reliable on tasks that ...

其他新闻

查看全部