返回新闻列表
2026-07-10 09:06

OpenAI发布GPT-5.6模型系列:Sol、Terra、Luna三版本上线,主打网络安全与高性价比

文本核心速览
  1. 三版本模型发布OpenAI发布GPT-5.6系列,包括主力版Sol、中级版Terra和经济型Luna,已在ChatGPT等平台上线,主打效率与成本优势。
  2. 编码性能创纪录Sol在ACI基准测试中斩获80分,比Anthropic的Fable5高2.8分,输出代币和耗时不足其一半,成本仅三分之二,代币效率提升54%。
  3. 最强网络安全模型GPT-5.6定位为OpenAI迄今最强网络安全模型,支持威胁建模、代码审查、漏洞补丁及蓝队演练,平衡前沿性能与合规安全。
  4. 办公工具与定价同步推出企业办公助手ChatGPT Work,支持多端运行;定价明确:Sol、Terra、Luna每百万输入/输出代币分别为5/30美元、2.50/15美元、1/6美元。

GPT-5.6 Sol 在编码测试中拿下 80 分,比对手 Fable5 高 2.8 分,成本却只有三分之二

7月9日,OpenAI 直接把 GPT-5.6 系列模型塞进了 ChatGPT、Codex 和 API 平台,三个版本同时上线。这个系列被内部定位为"迄今最强的网络安全模型"——要知道特朗普政府之前还想限制这类能力扩散。


模型阵容与定位

  • Sol:主力版本,号称最强编码模型,参数量没公开,但群里在传"比上一代贵了点但快得离谱"
  • Terra:中端版本,性能刚好压过 Anthropic 的 Fable5
  • Luna:经济型版本,实测也能打平甚至战胜对手的 Opus4.8

每百万输入/输出代币定价分别是:Sol 5美元/30美元Terra 2.50美元/15美元Luna 1美元/6美元。贵不贵?对比 Anthropic 的 Fable5,Sol 的产出成本只有三分之二。


安全与合规

有开发者试了说,GPT-5.6 在防御性安全任务上特别狠——威胁建模、代码审查、漏洞补丁、蓝队演练全都能跑。这个能力在特朗普政府曾试图限制其推广的背景下,相当于 OpenAI 硬着头皮把安全合规做成了产品亮点。


编码性能碾压

在行业权威的 AI 分析编码代理指数(ACI)基准测试中,Sol 直接拿下 80 分,创下新纪录。比 Anthropic 最近发布的 Fable5 高出 2.8 分。更具杀伤力的是:Sol 输出同样代码,消耗的代币和耗时都不到 Fable 的一半,成本只有三分之二。群里在传"这效率差距够 Anthropic 喝一壶的"。

CEO Sam Altman 在内部邮件里说,GPT-5.6 的核心优势就是效率和成本,其中 Sol 的 AI 编码代币效率提升了 54%(这数据是官方透露的,但实测的开发者已经确认了)。


企业办公工具

同步上线的还有一款叫 ChatGPT Work 的办公助手,支持桌面、网页和移动端。它能自动起草文档、生成电子表格和演示文稿——说白了就是抢微软 Copilot 和 Google Workspace 的活儿。


谁的蛋糕被动了

本周 SpaceXAI 和 Meta 也在密集发布同类模型,大模型战场已经彻底从"谁的参数大"变成"谁的场景能省钱"。接下来盯着看:企业客户会不会大规模从 Anthropic 倒戈到 OpenAI?SpaceXAI 的新模型效能到底能不能打?这让 Anthropic 最难受——刚靠企业端翻身,转眼就被 OpenAI 用性价比和编码跑分双重施压。

来源: aibase阅读原文

其他新闻

查看全部