返回新闻列表
2026-08-15 09:13

OpenAI发布GPT-5.6 Sol超快模式,速度飙升14倍

OpenAI 正式发布 GPT-5.6 Sol“超快”模式

近日,OpenAI 正式推出了备受瞩目的 GPT-5.6 Sol“超快”模式。早在今年 7 月,该版本便已面向部分特定客户进行内部预览,如今终于向更广泛的用户群体开放。这一模式的输出速度最高可达每秒 750 个 token,在不更换为更小或性能较低模型的前提下,整体处理速度比标准模式快了最高达 14 倍,堪称算力狂飙。

技术核心:Cerebras 晶圆级引擎

这次性能跃升主要得益于 Cerebras 的晶圆级引擎(Wafer-Scale Engine)架构。该架构内置了 44GB 的片上静态随机存取存储器(SRAM),成功打破了以往基于 GPU 系统常见的数据传输瓶颈。传统 GPU 架构中,数据在显存与计算单元之间频繁搬运,而晶圆级引擎将海量计算资源与高速存储集成在同一块硅片上,大幅减少了数据移动延迟,从而实现了惊人的吞吐量。

根据相关测试数据,其运行速度不仅大幅超越同类竞品,在“人类终极考试”(Humanity's Last Exam)中更是仅用约 11 个小时就处理完了全部 2500 道题目,展现出极高的计算效率。

适用场景:高强度工作流

目前,这一全新模式非常契合以下几类对实时性和算力要求极高的工作流:

  • 事件响应:在突发事件中快速分析海量数据,提供即时决策支持。
  • 金融研究:实时处理市场动态、财报数据,快速生成投资洞察。
  • 实时客户支持:以极低延迟响应用户咨询,提升客服体验。
  • 编程:加速代码生成、review 和调试过程。
  • 复杂研究:处理长文档、多学科交叉问题,缩短研究周期。

访问权限:逐步开放

鉴于算力资源目前仍然有限,OpenAI 将根据客户的工作负载契合度及算力可用性,逐步评估并发放访问权限。这意味着并非所有用户都能立即体验到这一超快模式,但 OpenAI 表示会优先考虑对高吞吐量有刚性需求的行业客户。

展望

GPT-5.6 Sol“超快”模式的推出,标志着大模型推理速度跨上了一个新台阶。尤其是与 Cerebras 的深度合作,展示了一种不同于传统 GPU 集群的算力路径。未来,随着晶圆级引擎技术的成熟和产能提升,我们有望看到更多“超快”模式落地,进一步推动 AI 在实时场景中的普及。

对于开发者而言,这一模式的出现也意味着需要重新思考如何设计系统来充分利用超高吞吐量——无论是优化提示词、批量处理还是流式输出,都将迎来新的可能性。OpenAI 表示,后续会根据反馈持续优化该模式的稳定性和可用性,让更多用户受益。

本文基于 OpenAI 官方发布的信息整理。

来源: aibase阅读原文

其他新闻

查看全部