限流
Rate Limit
AI 编程也叫:限速、频率限制、429 错误、配额
一句话:服务方限制你在一段时间内能发多少请求或用多少 Token,超出后会暂时拒绝,常见报错码是 429。
详细解释
限流像热门餐厅限量点单:厨房产能有限,每桌每小时只能点这么多,点多了就请你稍等。大模型服务通常按每分钟请求数、每分钟 Token 数、每天用量等维度限制,超出后返回 429 状态码或 rate limit exceeded 之类的提示。
你可能在两种场景遇到它:一是使用 AI 编程工具时额度用完,要等一会儿或换个模型;二是你开发的产品调用大模型 API,用户一多就触发限制。
第二种情况下,代码要做好处理:遇到 429 时等一会儿再重试,且每次等待时间逐渐加长(指数退避);界面上给用户友好的提示;前端做防抖,避免用户连续点击发出一堆请求。
怎么跟 AI 说
可以直接贴给 Cursor、Claude Code 等工具,把里面的业务内容换成你自己的。
调用大模型接口时偶尔返回 429 错误。请在服务端请求函数里加上重试逻辑:最多重试 3 次,等待时间依次加长;仍失败时返回明确的错误信息,前端提示「请求太频繁,请稍后再试」,并给发送按钮加上防抖。