起因很小。

我想给一个自动化脚本接个免费模型,跑批量分类。

于是去查 Gemini 免费额度一天能发多少个请求。

查不到。

不是我不会搜。

是 Google 把那张表删了。

文档里现在什么都没有

Gemini 的 rate-limits 文档页,我全文搜了一遍。

「free tier」这个词,出现 0 次

页面上剩下三张表:按消费额的速率限制、各付费档位的资格门槛、Tier 1 到 Tier 3 的批处理额度。

免费档,一张表都没有。

正文只留了两句话。

限额可以在 Google AI Studio 里查看。

所列限额不作保证。

翻译一下就是:你想知道自己有多少额度,登录进去自己看,而且我们不承诺。

搜索结果里那些写着具体数字的文章,我对了一下,基本都是旧版文档的复制品。

它们彼此还矛盾。

而且没有一篇覆盖现在在卖的 3.x 系列。

抄那种数字,等于替 Google 编。

那就自己测

一开始我想的办法很笨:一直发,发到失败,数一数发了多少个。

这个办法有个硬伤。

你只能得到一个下界。

并发、重试、时间窗口边界,都会让你少数几个。

而且你永远不知道少了几个。

后来发现根本不用数。

Gemini 超限时返回的 429,响应体里直接带着限额本身。

错误的 details 里有个 google.rpc.QuotaFailure,每条 violation 都写明了配额名和配额值:

{
  "quotaId": "GenerateRequestsPerDayPerProjectPerModel-FreeTier",
  "quotaDimensions": { "model": "gemini-3.5-flash" },
  "quotaValue": "20"
}

触发一次超限,Google 自己把答案递给你。

这跟「发到失败再数一数」不一样。

自己数,并发和重试都会让你少算几个,只能得到一个偏保守的下限。

quotaValue 是 Google 报出来的准确值。

拿这个数去设计重试逻辑,差别很大。

结果:一天 20 次

Flash 档,gemini-3.7-flash3.6-flash3.5-flash3-flash-preview,全部是 5 RPM / 20 RPD

注意是 20 RPD

不是每分钟 20 个。

是一天总共二十个请求。

我一开始以为读错了,又换了两个模型确认。

没读错。

Flash-Lite 宽松一些,15 RPM / 500 RPD。

Embedding 是 100 RPM / 1000 RPD。

20 次能干什么

一次 agent 任务,带工具调用的,往返十几次是常态。

所以 Flash 档的免费额度,一天大概够跑一到两个完整的 agent 任务。

我原本想干的那个批量分类脚本?

第一次跑就撞墙。

批处理、自动化、接进流水线——这条路基本没了。

Flash-Lite 那 500 次还行,做分类、抽取、打标签够用。

被砍掉的是「拿免费 Flash 跑正经活」这条路。

顺带发现:2.5 系列对新用户关了

测的时候顺手发现的。

gemini-2.5-progemini-2.5-flashgemini-2.5-flash-lite

拿当天新建的 key 打过去,全部 404。

错误信息写得很清楚:该模型对新用户不再开放。

我在新加坡和东京各验了一遍,一致。

但 Google 的定价页至今还把这三个列为免费。

这件事值得单独记一笔。

厂商文档可以比厂商自己的 API 更旧。

你在页面上看到「Free of charge」,不代表你拿 key 打过去能拿到。

做对比表、做目录、做选型的,都容易在这里翻车——包括我自己,我那个免费额度列表页上就挂了三条读者根本打不开的条目,是这次才发现的。

完整数据和复现方法

七个模型的完整 RPM/RPD、429 响应体的原样、三个配额名的区别,还有一条你自己就能跑的验证命令,我整理在这里:

Gemini 免费额度实测:Flash 一天 20 次,而 Google 不再公开这个数字

各家免费额度的横向对照,每天重新采集:aiplug.work/deals

最后提醒一句:这些数字随时会变,Google 也明说了不保证。

想确认自己项目的真实额度,拿把一次性 key 自己打一遍就知道了——记得是一次性的,测完当天这个项目就没额度了。