起因很小。
我想给一个自动化脚本接个免费模型,跑批量分类。
于是去查 Gemini 免费额度一天能发多少个请求。
查不到。
不是我不会搜。
是 Google 把那张表删了。
文档里现在什么都没有
Gemini 的 rate-limits 文档页,我全文搜了一遍。
「free tier」这个词,出现 0 次。
页面上剩下三张表:按消费额的速率限制、各付费档位的资格门槛、Tier 1 到 Tier 3 的批处理额度。
免费档,一张表都没有。
正文只留了两句话。
限额可以在 Google AI Studio 里查看。
所列限额不作保证。
翻译一下就是:你想知道自己有多少额度,登录进去自己看,而且我们不承诺。
搜索结果里那些写着具体数字的文章,我对了一下,基本都是旧版文档的复制品。
它们彼此还矛盾。
而且没有一篇覆盖现在在卖的 3.x 系列。
抄那种数字,等于替 Google 编。
那就自己测
一开始我想的办法很笨:一直发,发到失败,数一数发了多少个。
这个办法有个硬伤。
你只能得到一个下界。
并发、重试、时间窗口边界,都会让你少数几个。
而且你永远不知道少了几个。
后来发现根本不用数。
Gemini 超限时返回的 429,响应体里直接带着限额本身。
错误的 details 里有个 google.rpc.QuotaFailure,每条 violation 都写明了配额名和配额值:
{
"quotaId": "GenerateRequestsPerDayPerProjectPerModel-FreeTier",
"quotaDimensions": { "model": "gemini-3.5-flash" },
"quotaValue": "20"
}
触发一次超限,Google 自己把答案递给你。
这跟「发到失败再数一数」不一样。
自己数,并发和重试都会让你少算几个,只能得到一个偏保守的下限。
quotaValue 是 Google 报出来的准确值。
拿这个数去设计重试逻辑,差别很大。
结果:一天 20 次
Flash 档,gemini-3.7-flash、3.6-flash、3.5-flash、3-flash-preview,全部是 5 RPM / 20 RPD。
注意是 20 RPD。
不是每分钟 20 个。
是一天总共二十个请求。
我一开始以为读错了,又换了两个模型确认。
没读错。
Flash-Lite 宽松一些,15 RPM / 500 RPD。
Embedding 是 100 RPM / 1000 RPD。
20 次能干什么
一次 agent 任务,带工具调用的,往返十几次是常态。
所以 Flash 档的免费额度,一天大概够跑一到两个完整的 agent 任务。
我原本想干的那个批量分类脚本?
第一次跑就撞墙。
批处理、自动化、接进流水线——这条路基本没了。
Flash-Lite 那 500 次还行,做分类、抽取、打标签够用。
被砍掉的是「拿免费 Flash 跑正经活」这条路。
顺带发现:2.5 系列对新用户关了
测的时候顺手发现的。
gemini-2.5-pro、gemini-2.5-flash、gemini-2.5-flash-lite。
拿当天新建的 key 打过去,全部 404。
错误信息写得很清楚:该模型对新用户不再开放。
我在新加坡和东京各验了一遍,一致。
但 Google 的定价页至今还把这三个列为免费。
这件事值得单独记一笔。
厂商文档可以比厂商自己的 API 更旧。
你在页面上看到「Free of charge」,不代表你拿 key 打过去能拿到。
做对比表、做目录、做选型的,都容易在这里翻车——包括我自己,我那个免费额度列表页上就挂了三条读者根本打不开的条目,是这次才发现的。
完整数据和复现方法
七个模型的完整 RPM/RPD、429 响应体的原样、三个配额名的区别,还有一条你自己就能跑的验证命令,我整理在这里:
Gemini 免费额度实测:Flash 一天 20 次,而 Google 不再公开这个数字
各家免费额度的横向对照,每天重新采集:aiplug.work/deals
最后提醒一句:这些数字随时会变,Google 也明说了不保证。
想确认自己项目的真实额度,拿把一次性 key 自己打一遍就知道了——记得是一次性的,测完当天这个项目就没额度了。
