AI API RPM/TPM 限流计算器本地处理 · 0 次网络请求
根据模型 RPM/TPM 限流档位、并发数和单次 token 用量,计算实际利用率、最大可支持并发数和超限警告。覆盖 GPT-4o/Claude/Gemini/DeepSeek/Qwen 等 18+ 模型公开档位。
RPM/TPM 限流计算器怎么用?
填入并发数、平均输入/输出 token 和单次请求耗时,立即得到:
- 实际利用率:RPM 和 TPM 的占用百分比(> 80% 警告,> 100% 超限)
- 最大可支持并发数:不超过任一档位的最大并发
- 理论最大 RPS:受 RPM 和 TPM 共同约束的每秒请求数
用估算并发数 vs 模型限流档位,部署前就能知道是否需要申请 Tier 升级或排队重试。
页面更新: · 本地处理与使用边界