返回新闻列表
2026-07-22 09:08

谷歌发布 Gemini3.6Flash 等三款新模型,旗舰3.5Pro 延期发布

文本核心速览
  1. 三款中轻量模型发布谷歌DeepMind于7月21日发布Gemini 3.6Flash、3.5Flash-Lite和3.5Flash Cyber三款模型,主攻效率与落地应用。
  2. 主力3.6Flash性能升级Gemini 3.6Flash在代码、知识及多模态能力上显著增强,同时Token用量减少17%,降低调用成本。
  3. 轻量与安全专用模型3.5Flash-Lite主打超高性价比;3.5Flash Cyber专攻网络安全,以试点形式向政府机构开放用于漏洞修复。
  4. 旗舰3.5Pro延期发布Gemini 3.5Pro自2月更新后因内部性能挑战延迟,目前处于partner阶段测试,官方争取尽快上线。
  5. 应对竞争的持续投入面对OpenAI和Anthropic的竞争,谷歌研发高效服务器芯片并启动Gemini 4前沿预训练,加强AI基础设施。

7月21日谷歌DeepMind三模型上架,Gemini3.6Flash调用成本打八三折

谷歌DeepMind于7月21日直接上架三款模型——Gemini3.6Flash、3.5Flash-Lite和3.5Flash Cyber,分别强化中轻量级模型效率和落地能力。

三款模型齐发

核心更新是Gemini3.6Flash,它在代码编写、知识理解和多模态能力上都有明显提升,同时Token用量砍掉17%——这意味着调用成本直接打八三折,算下来每单位Token省了将近两成钱。

Gemini3.5Flash-Lite主打性价比,追求轻量体验;Gemini3.5Flash Cyber则是网络安全特供版,目前仅以试点形式向政府机构和信任伙伴开放,专门干漏洞识别和修复的活儿。

有开发者试用后反馈,这三款模型正是为那些大规模搭建AI Agent的企业客户准备的,主打高可靠和低延迟的基础设施支持。群里有人吐槽说,这种精准分层让下游选模型时不用再纠结资源浪费了。

旗舰Gemini3.5Pro延期

但这次更新没带旗舰模型Gemini3.5Pro出来,让不少人等到心焦。这个模型自2月更新后就因为内部性能测试卡壳而延迟发布,现在还在合作伙伴测试阶段,群里都在传“争取尽快上线”。开发者抱怨说,没有Pro版压阵,多模态场景下的高负载任务只能靠Flash硬扛,效果肯定打折扣。

硬件与未来布局

面对OpenAI连发GPT-5.5和5.6、Anthropic推出Claude Opus4.8和Sonnet5的双重夹击,谷歌在硬件和软件两边同时发力。内部代号“Frozen v2”的高效服务器芯片已经被曝出,同时启动了迄今规模最大的Gemini4前沿预训练——这摆明了要在AI基础设施和下一代大模型领域持续投入。有开发者试了说,Frozen v2的能效比传言中提升了30%以上,但还没公开实测数据。

接下来盯着看Gemini3.5Pro何时上线,以及谷歌的Frozen v2芯片能否加速推理。这波操作直接把轻量模型价格打下来了,OpenAI和Anthropic的中小模型会很难受。

来源: aibase阅读原文

其他新闻

查看全部