AI API速率限制计算器
计算各大AI厂商API速率限制(RPM/TPM/RPD),智能规划调用策略,避免触发限流
计算器界面
交互式计算器即将上线
功能特点
- ✓ 覆盖OpenAI、Claude、Gemini、DeepSeek等50+厂商最新限额数据
- ✓ 支持RPM(每分钟请求数)、TPM(每分钟Token数)、RPD(每日请求数)计算
- ✓ 智能规划并发数和调用间隔,最大化吞吐量
- ✓ 模拟真实业务场景,预估峰值负载和限流风险
- ✓ 生成最优调用策略代码(Python/Node.js/Go)
使用步骤
- 选择AI厂商和具体模型(自动加载限额数据)
- 输入业务参数:平均Token数、预期QPS、峰值倍数
- 点击计算,查看限流阈值和建议并发数
- 导出调用策略代码或配置到网关
常见问题
什么是RPM和TPM?
RPM(Requests Per Minute)是每分钟请求数限制;TPM(Tokens Per Minute)是每分钟Token数限制。两者同时生效,任一超限都会触发429错误。
免费版和付费版的限额差别大吗?
差别很大。如OpenAI免费版RPM仅3,付费Tier 1可达500 RPM。建议生产环境使用付费账户。
如何避免触发限流?
使用指数退避重试、请求队列、多Key轮换、缓存重复请求。本工具会生成对应策略代码。
不同Tier的限额是多少?
以OpenAI为例:Tier 1(付费$50+)500 RPM/300K TPM;Tier 2(付费$100+)5000 RPM/6M TPM。具体以官网为准。
能否计算多Key组合的总限额?
可以。输入多个Key及其Tier,工具自动计算聚合限额,并给出负载均衡建议。