429错误表明Gemini API的RPM或TPM配额已耗尽,需在Google Cloud Console中确认generativeai.googleapis.com服务下的Requests per minute和Tokens per minute使用情况,若达60/60或32000/32000则必须切换模型或添加节流逻辑。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

你在用 GeminiNotebook 调用 Gemini API 时频繁收到 429 错误,说明当前项目每分钟请求数(RPM)已耗尽,请求在鉴权前就被 Google Cloud 服务端直接拦截,所有后续调用全部失败,必须立即定位配额状态并干预。
确认是否真被 RPM 限流
第一步:打开 Google Cloud Console,确保登录的是 GeminiNotebook 所绑定的同一项目(注意不是 Google AI Studio 的默认项目,而是 Notebook 后台实际调用所用的 Cloud 项目)。
第二步:进入「API 和服务」→「配额」页面,在顶部服务筛选框中输入 generativeai.googleapis.com,确保选中该服务而非“Gemini API”旧名称(后者可能不显示实时数据)。
第三步:在指标列表中精准定位两行:Requests per minute per project 和 Tokens per minute per project。免费层默认 RPM=60、TPM=32,000,且二者独立生效——【哪怕你只发一个含28000 token的长请求,这一分钟内其余任何请求都会因TPM打满而返回429】。
第四步:重点看「已使用/限制」列数值。若显示 60/60、59/60 或 32000/32000,就是硬性配额触顶的明确信号;此时重试、换密钥、清缓存全无效。
立即缓解:三类可落地的绕过方案
方法一:切换低消耗模型路径
GeminiNotebook 默认可能调用 gemini-2.5-pro-preview-05-06,该模型 RPM 配额池已枯竭,但 gemini-1.5-flash 仍可能有余量。直接修改 Notebook 中的 model 参数:
把 model='gemini-2.5-pro-preview-05-06' 替换为 model='gemini-1.5-flash',其余参数(如 temperature、max_output_tokens)保持不变,重新运行单元格。
用于在用户想通过浏览器自动化与 Google Gemini 或 ChatGPT 交互时。触发短语包括“ask Gemini”“ask ChatGPT”“ask GPT”“让...”。
方法二:强制客户端节流
在 Notebook 最顶部插入以下 Python 代码块,作为全局请求守门员:
import time<br>last_call = 0<br>def throttle_gemini():<br> global last_call<br> elapsed = time.time() - last_call<br> if elapsed < 1.0:<br> time.sleep(1.0 - elapsed)<br> last_call = time.time()
每次调用
genai.GenerativeModel().generate_content() 前加一行 throttle_gemini()。这能确保每分钟最多 60 次,避免突发流量撞墙。
方法三:拆分批量请求
如果你在 Notebook 里一次性传入多条 prompt 构成 list 并循环调用,会快速耗尽 RPM。改为用 time.sleep(0.1) 在循环内逐条发送,或改用单次请求携带多个 parts(需手动拼接 contents 数组),减少请求数量。例如把 50 条独立 query 压成 1 次含 50 个 parts 的请求,RPM 计数只算 1 次。
永久解法:提升项目级 RPM/TPM 配额
第一步:绑定结算账号
进入 Google Cloud Console → 左侧「结算」→「管理结算账号」→ 点击「+ 创建结算账号」→ 输入有效信用卡并完成验证。未绑定则所有配额提升申请自动拒绝。
第二步:启用两步验证
访问 Google 账户安全中心 → 开启「两步验证」→ 必须完成短信或 Authenticator App 绑定。这是配额审批的硬性前置条件,跳过将导致提升失败。
第三步:提交配额提升申请
回到「配额」页面 → 找到 Requests per minute per project 行 → 点击右侧「编辑配额」→ 选择「增加配额」→ 填写理由(如实写“GeminiNotebook 教学实验需稳定调用,当前60 RPM无法支撑20人并发”)→ 提交。审核通常 3~5 分钟内生效,无需等待人工批复。

















