返回新闻列表
2026-07-03 09:10

谷歌全面扩容 Gemini API 免费额度:部分模型单分钟吞吐量翻至百万级

文本核心速览
  1. 免费配额大幅提升谷歌将Gemini API部分账户的免费配额上调,Gemini 2.5 Flash与Flash-Lite模型每分钟Token处理上限升至100万,且免绑卡、不限总量。
  2. 差异化策略与限制并非所有用户享顶级额度,请求频率限制为每分钟15-30次,每日请求总量锁定1500次,高端Pro模型暂未进入免费队列。
  3. 隐私数据使用说明谷歌有权利用免费层级的提示词与反馈进行模型训练,开发者可通过官方页面查看额度详情并评估是否升级付费版本。
  4. 行业影响与意义该策略旨在吸引开发者迁入API生态,在开源模型冲击下以高性价比稳固推理服务市场地位,降低个人构建复杂AI应用门槛。

谷歌对部分账户的Gemini API免费TPM升至100万,但每天最多1500次请求

谷歌近日在开发者生态里搞了件大事:针对部分账户的Gemini API免费配额大幅上调,Gemini2.5 Flash和Flash-Lite两款模型的单分钟Token处理上限(TPM)已经正式提到100万。有开发者试了说,这相当于每分钟能处理一部中等长度小说的文字量,对个人项目来说基本够用。更关键的是,这个免费层级依然保持“免绑卡、不限总量”——你不用掏信用卡,也没有总使用量上限,白嫖党狂喜。

不是所有账户都能爽到

群里在传,这次上调有明显的“差异化”特征。并非每个开发者都能拿到100万TPM的顶级额度,不同模型之间的性能限制依然存在。虽然Token处理上限放宽了,但请求频率限制(RPM)被卡在每分钟15次到30次不等,每日请求总量(RPD)锁定在1500次——也就是说,你每分钟能发30次请求,一天最多跑1500次,多了就得等明天。另外,Pro版本模型目前暂未进入免费开放队列,高端用户还得自己掏钱。

免费的代价:你的Prompt可能被拿去训练

对于关注隐私的开发者,有个细节得留心:谷歌在服务条款里明确指出,它有权利用免费层级下的提示词(Prompt)与反馈内容进行模型训练。有开发者吐槽说,这相当于你一边白嫖API,一边帮谷歌喂数据。如果你介意,可以通过官方查询页面查看当前账户的具体额度详情,并根据业务敏感度评估是否要升级到付费版本。

谷歌这步棋让谁难受?

行业人士议论说,谷歌此举不光是为了用高规格免费配额把开发者拉进API生态,更是想在开源模型冲击下,靠极致性价比稳住推理服务市场的领先地位。随着免费策略铺开,个人开发者构建复杂AI应用的门槛会被进一步压低。接下来盯着看:谷歌会不会把Pro版也放进免费序列?开源模型(比如Meta的Llama系列)会不会被迫降价?以及,那些靠卖API盈利的小厂日子可能不太好过了。

来源: aibase阅读原文

其他新闻

查看全部