OpenAI发布GPT-5.6模型系列:Sol、Terra、Luna三版本上线,主打网络安全与高性价比
- 三版本模型发布—OpenAI发布GPT-5.6系列,包括主力版Sol、中级版Terra和经济型Luna,已在ChatGPT等平台上线,主打效率与成本优势。
- 编码性能创纪录—Sol在ACI基准测试中斩获80分,比Anthropic的Fable5高2.8分,输出代币和耗时不足其一半,成本仅三分之二,代币效率提升54%。
- 最强网络安全模型—GPT-5.6定位为OpenAI迄今最强网络安全模型,支持威胁建模、代码审查、漏洞补丁及蓝队演练,平衡前沿性能与合规安全。
- 办公工具与定价—同步推出企业办公助手ChatGPT Work,支持多端运行;定价明确:Sol、Terra、Luna每百万输入/输出代币分别为5/30美元、2.50/15美元、1/6美元。
GPT-5.6 Sol 在编码测试中拿下 80 分,比对手 Fable5 高 2.8 分,成本却只有三分之二
7月9日,OpenAI 直接把 GPT-5.6 系列模型塞进了 ChatGPT、Codex 和 API 平台,三个版本同时上线。这个系列被内部定位为"迄今最强的网络安全模型"——要知道特朗普政府之前还想限制这类能力扩散。
模型阵容与定位
- Sol:主力版本,号称最强编码模型,参数量没公开,但群里在传"比上一代贵了点但快得离谱"
- Terra:中端版本,性能刚好压过 Anthropic 的 Fable5
- Luna:经济型版本,实测也能打平甚至战胜对手的 Opus4.8
每百万输入/输出代币定价分别是:Sol 5美元/30美元、Terra 2.50美元/15美元、Luna 1美元/6美元。贵不贵?对比 Anthropic 的 Fable5,Sol 的产出成本只有三分之二。
安全与合规
有开发者试了说,GPT-5.6 在防御性安全任务上特别狠——威胁建模、代码审查、漏洞补丁、蓝队演练全都能跑。这个能力在特朗普政府曾试图限制其推广的背景下,相当于 OpenAI 硬着头皮把安全合规做成了产品亮点。
编码性能碾压
在行业权威的 AI 分析编码代理指数(ACI)基准测试中,Sol 直接拿下 80 分,创下新纪录。比 Anthropic 最近发布的 Fable5 高出 2.8 分。更具杀伤力的是:Sol 输出同样代码,消耗的代币和耗时都不到 Fable 的一半,成本只有三分之二。群里在传"这效率差距够 Anthropic 喝一壶的"。
CEO Sam Altman 在内部邮件里说,GPT-5.6 的核心优势就是效率和成本,其中 Sol 的 AI 编码代币效率提升了 54%(这数据是官方透露的,但实测的开发者已经确认了)。
企业办公工具
同步上线的还有一款叫 ChatGPT Work 的办公助手,支持桌面、网页和移动端。它能自动起草文档、生成电子表格和演示文稿——说白了就是抢微软 Copilot 和 Google Workspace 的活儿。
谁的蛋糕被动了
本周 SpaceXAI 和 Meta 也在密集发布同类模型,大模型战场已经彻底从"谁的参数大"变成"谁的场景能省钱"。接下来盯着看:企业客户会不会大规模从 Anthropic 倒戈到 OpenAI?SpaceXAI 的新模型效能到底能不能打?这让 Anthropic 最难受——刚靠企业端翻身,转眼就被 OpenAI 用性价比和编码跑分双重施压。