跳到主要内容

Gemini API 免费额度与限制:哪些模型免费,超限怎么办

截至 2026 年 9 月 30 日,Gemini 3.5 Flash 等模型仍有免费层级,Nano Banana 图片模型没有;额度按项目计,每日请求数在太平洋时间午夜重置。

Yingtu AI Editorial
Yingtu AI Editorial
最后更新 9 min
Gemini API 免费额度与限制封面:Gemini 3.5 Flash 等有免费层级,Nano Banana 没有,每日请求数在北京时间 15:00(夏令时)重置
yingtu.ai

Gemini API 免费层级是 Google 在 Gemini Developer API 上为部分模型提供的不收费调用额度:不需要关联结算账号,只要有一个活跃的项目就能用。截至 2026 年 9 月 30 日,Gemini 3.5 Flash、Gemini 2.5 Pro、2.5 Flash 等文本模型仍然有免费层级,Nano Banana 系列图片模型、Veo 3.1 视频模型没有;额度按项目计算,分每分钟请求数(RPM)、每分钟 token 数(TPM)和每日请求数(RPD)三个维度,每日请求数在太平洋时间午夜重置。

Google 的公开文档已经不再列出每个模型的免费额度数字,你的项目具体能用多少,要在 AI Studio 的速率限制页里看。看到 "free tier limit reached" 或接口返回 429 RESOURCE_EXHAUSTED,说明这个项目在某一个维度上用完了额度,先判断是哪个维度,再决定是等、换模型还是开通结算。

哪些模型有免费层级(截至 2026 年 9 月 30 日)

下表依据 Gemini Developer API 价格页(页面更新于 2026 年 9 月 24 日),"有免费层级"指价格页免费层级一栏的输入、输出都标为免费。

用途有免费层级没有免费层级
文本与多模态对话Gemini 3.8 Flash、3.7 Flash、3.6 Flash、3.5 Flash;Gemini 2.5 Pro、2.5 FlashGemini 3.1 Pro Preview
轻量、高频调用Gemini 3.5 Flash-Lite、3.1 Flash-Lite、2.5 Flash-Lite—
实时语音对话Gemini 3.8 Live—
语音合成Gemini 3.8 Flash TTS、3.8 Flash-Lite TTS—
图片生成—Gemini 3.1 Flash Image(Nano Banana 2)、Gemini 3 Pro Image(Nano Banana Pro)
视频、音乐与多模态生成—Veo 3.1、Lyria 3.5、Gemini Omni Flash
其他Gemini Robotics ER 2 Preview、Gemini Embedding 2、Gemma 4—

三点容易看错:

  • 同一代模型不一定同时免费。Gemini 3.1 Flash-Lite 有免费层级,Gemini 3.1 Pro Preview 和 Gemini 3.1 Flash Image 没有,判断时要看具体的模型行,不能看系列名。
  • 做图的 Nano Banana 2 和 Nano Banana Pro 在 API 里只有付费层级。免费项目调用它们,拿到的是额度为 0 的报错,而不是一小份试用额度(见下文 429 一节)。
  • Gemini 3.x 模型的"使用 Google 搜索建立依据"另有一份额度:截至 2026 年 9 月 30 日,所有 3.x 模型共用每月 5,000 次免费搜索请求,超出后每 1,000 次 $14。

免费层级和第 1–3 层级:资格与支出上限

Gemini API 按"使用层级"分配限额。下表来自 速率限制文档,截至 2026 年 9 月 30 日:

使用层级获得条件支出上限每 10 分钟支出限额
免费有一个活跃项目,或处于免费试用期——
第 1 层级设置并关联一个有效的结算账号$250$10
第 2 层级已支付 $100,且距首次成功付款满 3 天$2,000$50
第 3 层级已支付 $1,000,且距首次成功付款满 30 天$20,000–$100,000 以上$200

层级之间不用申请,Google 会随着用量和支出增长自动升级项目。付费层级除了 RPM、TPM、RPD,还多了一道按滚动 10 分钟窗口计算的支出限额:第 1 层级的项目在任意 10 分钟里花到 $10,后续请求同样会收到 429 RESOURCE_EXHAUSTED。

批量 API 的限额与上面分开计算:最多 100 个并发批量请求,单个输入文件 2 GB,文件存储总量 20 GB。

你的免费额度是多少:去 AI Studio 看自己的项目

截至 2026 年 9 月 30 日,速率限制文档只说明限额的维度和规则,没有按模型列出免费层级的具体数字。规则有四条:

  1. 限额按项目计算,不按 API 密钥计算。同一个项目里建 5 个密钥,5 个密钥共用一份额度。
  2. 每个维度单独判断:RPM、TPM(只算输入 token)、RPD,图片模型还有每分钟图片数(IPM),部分模型还有每日 token 数(TPD)。任何一项超出都会触发速率限制错误。
  3. 每日请求数在太平洋时间午夜重置。截至 9 月 30 日美国仍处于夏令时,对应北京时间 15:00;11 月 1 日夏令时结束后对应北京时间 16:00。
  4. 当前生效的限额只在 AI Studio 里显示。

查自己的数字:

  1. 用创建 API 密钥的那个 Google 账号打开 AI Studio 速率限制页。
  2. 在页面顶部切到代码实际调用的那个项目。看错项目,看到的就是另一份额度。
  3. 找到代码里用的模型 ID(例如 gemini-2.5-flash),记下它的 RPM、TPM、RPD 和当前用量。
  4. 上线、做演示或流量变化前再看一次,限额会随 Google 调整而变。

网上流传的数字要带着日期看。2025 年 12 月,Reddit r/GeminiAI 和韩国论坛 클리앙 上都有用户报告 Gemini 2.5 Flash 的免费额度降到每天 20 次请求;2026 年 1 月 27 日一份第三方汇总表写的是 5–15 RPM、250,000 TPM、100–1,000 RPD。这些是用户和第三方的报告,不是 Google 公布的现行限额,你的项目以 AI Studio 显示为准。

出现 "free tier limit reached" 或 429 时怎么判断

429 RESOURCE_EXHAUSTED 的官方含义是超出了每分钟或每秒的请求数或 token 数限制,Google 给的处理方式是等待后按指数退避重试(API 错误文档)。但同样是 429,背后的维度不同,处理方法也不同:

你看到的情况多半是哪个维度该怎么做
一阵密集请求后报错,等几十秒又恢复RPM 或 TPM指数退避重试,降低并发,缩短输入
当天后半段一直失败,到北京时间 15:00(夏令时)或 16:00 才恢复RPD等太平洋时间午夜重置,或换一个仍有免费层级的模型
报错里写着 limit: 0,第一次调用就失败这个模型在你的项目上没有免费额度换用上表"有免费层级"的模型,或开通结算
已开通结算,短时间内集中发大量高价请求后报 42910 分钟支出限额放慢高价请求,等窗口滚过
返回 400 FAILED_PRECONDITION前置条件不满足,例如结算已停用检查结算状态,等待没有用
返回 403API 密钥对这个资源没有权限检查密钥和项目权限,不是额度问题
返回 402 Payment Required,同一结算账号下所有项目的密钥同时失效预付费余额已经归零给结算账号充值,充值前会一直失败

Google AI Developers Forum 2026 年 1 月 6 日的一个帖子提到,Google 取消了若干模型的免费层级访问,免费项目调用这些模型时,报错里的 limit 就是 0。对照上一节的模型表,最常见的就是在免费项目里直接调用 Nano Banana 图片模型或 Gemini 3.1 Pro Preview。

有两件事不起作用:在同一个项目里新建 API 密钥(额度按项目算),以及不带间隔地立刻重试(会让 RPM 更快耗尽)。

下面的重试只对 429 生效,400、403 这类不会因为等待而好转的错误直接抛出:

hljs python
# pip install google-genai tenacity
from google import genai
from google.genai import errors
from tenacity import retry, retry_if_exception, stop_after_attempt, wait_exponential

client = genai.Client()  # 从环境变量 GEMINI_API_KEY 读取密钥


def is_rate_limited(exc: BaseException) -> bool:
    return isinstance(exc, errors.APIError) and exc.code == 429


@retry(
    retry=retry_if_exception(is_rate_limited),
    wait=wait_exponential(multiplier=1, min=2, max=60),  # 2、4、8…秒,最长 60 秒
    stop=stop_after_attempt(5),
)
def ask(prompt: str) -> str:
    response = client.models.generate_content(
        model="gemini-2.5-flash",
        contents=prompt,
    )
    return response.text


print(ask("用一句话解释什么是速率限制"))

重试 5 次仍然失败,通常说明撞上的是 RPD 或 limit: 0,这时继续重试只会浪费时间,按上表换模型、等重置或开通结算。

Gemini Pro 有 API 额度吗

这个问题有两种意思,答案不一样。

如果问的是 Gemini Pro 模型:截至 2026 年 9 月 30 日,Gemini 2.5 Pro 在价格页上有免费层级;Gemini 3.1 Pro Preview 没有,只能在付费层级调用。

如果问的是 Google AI Pro 或 Ultra 订阅:订阅本身不包含 Gemini API 额度。按 Google AI 方案说明(截至 2026 年 9 月 30 日),订阅权益只在 Google AI Studio 的网页界面里生效,直接调用 Gemini API 另行计费、另行管理。订阅用户能拿到的是另一样东西:

  • 有 Google Cloud 项目并启用了 Cloud Billing 的 Google AI Pro、Ultra 订阅用户,可以每月从 Google 开发者计划领取 Cloud 赠金,赠金会优先抵扣 API 费用。
  • 用预付费方式的账号,余额要大于 $0 才能激活这类促销赠金。
  • 赠金金额在 Google 页面上没有写明。Google AI Developers Forum 2026 年 6 月 11 日的帖子里,有用户报告 AI Pro 每月是 $10,这是用户报告,不是 Google 的公开承诺。

另外,Gemini 网页版和手机 App 的对话次数限制是另一套规则,不能拿来推算 Gemini API 的 RPM、RPD。

什么时候该开通结算

免费层级适合学习 API、调试提示词、做低频的内部原型。出现下面任何一种情况,就该考虑给项目开通结算:

  • 正常流量下每天都会撞到 RPD,而不是偶尔一次的峰值。
  • 你要用的模型本来就没有免费层级,例如 Nano Banana 图片模型、Veo 3.1、Gemini 3.1 Pro Preview。
  • 请求里有客户资料、商业数据等敏感内容。截至 2026 年 9 月 30 日,价格页写明免费层级的内容会被用于改进 Google 的产品,付费层级不会。
  • 应用面向真实用户,失败会直接影响他们。

开通方式(结算文档,截至 2026 年 9 月 30 日):

  1. 在 AI Studio 的 API 密钥页或项目页,点对应项目旁的 "Set up billing"。
  2. 结算方式分预付费和后付费两种。预付费最低充值 $5,费用几乎实时从余额里扣;后付费按月结算。预付费余额一旦降到 $0,关联到这个结算账号的所有项目里的所有 API 密钥会同时停用,请求返回 HTTP 402 Payment Required,直到充值为止,不会退回免费层级继续跑。
  3. 关联结算账号后,项目进入第 1 层级,支出上限 $250、每 10 分钟支出限额 $10;之后按上文的条件自动升到第 2、3 层级。

Google Cloud 新用户拿到的欢迎赠金或免费试用赠金不能用来支付 Gemini API 和 AI Studio 的费用;从 2026 年 3 月起,Gemini API 的用量费用也被明确排除在 $300 的 Google Cloud 免费试用计划之外。做预算时不要把这笔试用金算进去。

在中国大陆能用 Gemini API 吗

不能直接用。截至 2026 年 9 月 30 日,Google 的 可用地区列表里没有中国大陆和香港,AI Studio 与 Gemini API 都只在列出的地区提供;从中国大陆网络打开 AI Studio 的速率限制页,会被跳转到"可用地区"说明页。

对列表之外的地区,Google 的建议是改用 Gemini Enterprise Agent Platform 中的 Gemini API。

另一条路是第三方 API 网关。LaoZhang API 提供 Gemini 模型的调用,既支持原生 Gemini 格式(generateContent,Google Gen AI SDK 可把服务地址改为 https://api.laozhang.ai),也支持 OpenAI 兼容格式,按 token 或按次付费,具体看模型;接入方式见 文档。它不是 Google 的官方渠道,适合所在地区不在 Google 支持列表里、或者要用 Nano Banana 这类本来就没有免费层级的图片模型的开发者。

常见问题

Gemini API 免费吗?

部分模型免费。截至 2026 年 9 月 30 日,Gemini 3.5 Flash、2.5 Flash、2.5 Pro、各个 Flash-Lite 等模型有免费层级,Nano Banana 图片模型、Veo 3.1、Gemini 3.1 Pro Preview 没有。免费层级有 RPM、TPM、RPD 限额,具体数字在 AI Studio 的速率限制页里看。

用 Gemini API 免费层级要绑信用卡吗?

不用。免费层级的条件是有一个活跃项目或处于免费试用期;只有进入第 1 层级才需要设置并关联结算账号。需要注意,Google Cloud 的 $300 免费试用金不能抵扣 Gemini API 费用,一旦要用付费模型,就得实际充值或按月付费。

Gemini API 的免费额度什么时候重置?

每日请求数在太平洋时间午夜重置,夏令时期间是北京时间 15:00,冬令时是 16:00。每分钟请求数和每分钟 token 数按分钟计算,触顶后等一分钟左右通常就能恢复。

多建几个 API 密钥能多拿额度吗?

不能。限额按项目计算,同一项目里的所有 API 密钥共用一份额度。新建密钥适合轮换和区分环境,不会增加额度。

Nano Banana 能用免费额度吗?

不能。截至 2026 年 9 月 30 日,Gemini 3.1 Flash Image(Nano Banana 2)和 Gemini 3 Pro Image(Nano Banana Pro)在 Gemini API 里没有免费层级,免费项目调用会返回 limit: 0 的 429 错误,要开通结算才能用。

2025 年 12 月的免费额度削减现在还算数吗?

那次调整的数字都来自用户报告,Google 没有在文档里公布过调整前后的对照表。之后模型和额度又有变化,你的项目现在能用多少,以 AI Studio 速率限制页的显示为准。

文章标签

#Gemini API#免费额度#速率限制#AI Studio#429 错误

分享这篇文章

XTelegram