跳到主要内容

AI 调用报 429 错误或 Token 额度超限

在调用云开发 AI 大模型时,可能会遇到 429 Too Many RequestsEXCEED_TOKEN_QUOTA_LIMIT 错误。本文介绍常见原因和解决方案。

问题现象

调用 AI 大模型 API 时,返回以下错误之一:

  1. HTTP 429 Too Many Requests
  2. 错误码 EXCEED_TOKEN_QUOTA_LIMIT:提示 Token usage exceeded quota limit
{
"code": "EXCEED_TOKEN_QUOTA_LIMIT",
"message": "Token usage exceeded quota limit."
}

常见原因

原因一:Token 额度用完

不同模型的免费额度是独立计算的:

免费额度来源适用范围
AI 小程序成长计划(10 亿 Token)仅限混元系列模型
CloudBase 环境赠送的 100 万 TokenDeepSeek 系列模型、混元系列模型

注意:调用 DeepSeek 模型时,如果环境赠送的 Token 消耗完,无法使用 AI 小程序成长计划赠送的 Token。

原因二:并发请求超限

云开发 AI 接口默认有并发限制(默认 10 并发)。系统有 2 层并发控制:

  • 环境级并发:每个云开发环境有 10 个并发
  • 整体资源池并发:大模型整体有总的并发上限,即其他用户的请求量太大,服务器处理不过来更多请求

一个请求从发出后,到响应完成之前记为一个并发。

注意:即使单个环境没有超过 10 个并发,如果整体资源池达到瓶颈(其他用户请求量太大),也会返回 429 Too Many Requests。开发者需要结合自身业务的请求量进行判断。

原因三:调用来源不符合要求

AI 小程序成长计划赠送的 Token 仅限以下调用来源使用:

  • 小程序端调用
  • 管理员身份调用(包含控制台体验、云函数中调用等)

解决方案

方案一:检查 Token 使用情况

  1. 登录 云开发控制台
  2. 进入 AI 模块
  3. 查看各模型的 Token 消耗情况

方案二:提升并发额度

如果是并发超限导致的 429 错误,可以:

  1. 重试请求:稍后重试请求,避开并发高峰
  2. 切换模型重试:切换到其他模型后重试(如从 DeepSeek 切换到混元系列),不同模型的资源池相互独立
  3. 提交工单申请提升并发额度
  4. 在社区 Issue 中提供环境 ID 申请提升

方案三:切换模型

如果当前使用的模型额度已用完,可以考虑切换到其他模型(如从 DeepSeek 切换到混元系列)。

方案四:配置自定义模型

可以配置自己的大模型 API Key 使用,详情参考:接入大模型

相似问题

  1. AI 调用报 429 Too Many Requests 怎么解决?
  2. EXCEED_TOKEN_QUOTA_LIMIT 错误是什么意思?
  3. DeepSeek 模型免费额度是多少?
  4. 混元模型的 Token 额度能用于 DeepSeek 吗?
  5. 云开发 AI 默认并发限制是多少?
  6. 如何提升 AI 调用的并发额度?
  7. AI 小程序成长计划赠送的 Token 适用于哪些模型?
  8. 如何查看 AI Token 使用情况?
  9. Token 额度用完后如何继续使用 AI 功能?
  10. 云开发 AI 调用频繁报错怎么办?

相关文档