ARTICLE DETAIL

建站实战干货

来自一线的建站与推广经验沉淀,每一条都经过真实交付验证。

codex-lb API密钥详解:Token、成本、时间窗、模型与账号绑定的5维限流

2026/9/28 19:18:34 拓冰建站 浏览量
codex-lb API密钥详解:Token、成本、时间窗、模型与账号绑定的5维限流 codex-lb API密钥详解Token、成本、时间窗、模型与账号绑定的5维限流【免费下载链接】codex-lbCodex/ChatGPT multiple account load balancer proxy with usage tracking, dashboard, and OpenCode-compatible endpoints项目地址: https://gitcode.com/gh_mirrors/co/codex-lbcodex-lb是一个面向 Codex/ChatGPT 多账号的负载均衡代理其API密钥API Key不仅承担客户端认证更是精细限流的核心抓手你可以按Token 数量、美元成本、时间窗口、模型范围、绑定账号这 5 个维度组合出配额策略实现按预算管流量。本文带你从新手视角完整看懂这套 5 维限流机制 一、API密钥是什么如何启用与创建codex-lb 的API Key 认证默认关闭。开启后客户端必须携带密钥访问受保护代理路由/v1/*、/backend-api/codex/*、/backend-api/transcribeAuthorization: Bearer sk-clb-...开启路径控制面板Settings → API Key Auth。详细文档见 api-keys.md。创建密钥非常简单Dashboard → API Keys → Create。需要注意两点 完整密钥只在创建时展示一次务必妥善保存密钥支持可选的过期时间expires_at到期后自动拒绝请求。二、维度一Token 限流三种口径在 schemas.py 中可以看到限流规则支持 5 种limit_type其中 Token 类占 3 种类型含义适用场景total_tokens输入 输出总 Token最通用的总量控制input_tokens仅输入 Token限制长上下文塞入output_tokens仅输出 Token防止超长生成刷量实现上请求进入时代理会先预留额度reserve再按上游实际用量结算settle。相关逻辑位于 service.py 的_reserve_budget_for_limit_type中保证并发下不会超发额度。三、维度二成本限流cost_usdcost_usd规则按美元设上限。系统内部以微美元microdollar1 美元 100 万单位记账按请求的模型价格 × Token 数预估扣减若模型未知则按保守的兜底单价估算见 service.py 的_unknown_model_reserve_cost_budget_microdollars。 成本限流 未知模型兜底单价意味着即使遇到新模型也没办法绕过预算白嫖——这是新手容易忽略的安全细节。四、维度三时间窗限流5种窗口limit_window支持 5 种窗口在 models.py 的LimitWindow枚举中定义daily每日重置weekly每周重置monthly每月重置5h/7d对齐上游 Codex 的 5 小时 / 7 天额度节奏窗口重置采用惰性重置 推进策略到期不主动清零而是下次请求时自动把reset_at向前推进到第一个大于当前的重置点实现见 limit_windows.py 的advance_limit_reset——省掉了定时任务重启也不丢状态。⚠️ 当current_value max_value时请求会被直接拒绝并返回限流错误每个窗口各自独立计数互不干扰。五、维度四模型维度限流与模型管控模型管控有两层1密钥级模型策略allowed_models密钥只允许调用列出的模型enforced_model强制把请求改写到指定模型客户端写什么都会被覆盖apply_to_codex_model是否将上述策略应用到 Codex 模型。2限流规则的模型过滤LimitRuleCreate中的model_filter字段让每条配额规则只针对特定模型生效例如gpt-5 每周限 1000 万 Token其他模型不限判断逻辑在 service.py 的_limit_applies_for_request中请求模型不匹配的规则会被跳过实现分模型差异化配额。六、维度五账号绑定限流只消耗指定账号额度这是最实用的维度——把密钥绑定到指定账号池assigned_account_ids后该密钥只从被分配的账号中消耗配额互不抢占。典型用法团队 A 的生产密钥 → 绑定 2 个 Plus 账号团队 B 的测试密钥 → 绑定 1 个 Team 账号某个账号额度耗尽时只影响绑定它的密钥故障域被隔离。七、配额组合实战一个新手友好的配置清单综合 5 个维度一个稳妥的生产密钥通常这样配维度配置示例作用Tokentotal_tokens/weekly 5,000,000控总量成本cost_usd/weekly 20防超预算时间窗5hweekly双规则对齐上游节奏模型allowed_models [gpt-5.x-codex]只放行指定模型账号绑定 2 个活跃账号隔离故障域配置完成后可在密钥卡片上直接查看usage_summary请求数、总 Token、缓存命中 Token、累计成本与limits中每条规则的current_value/remaining_value/reset_at数据模型定义见 schemas.py 的ApiKeyResponse。八、常见问题FAQQ1限流被触发会怎样请求会收到明确的限流错误提示含触发的是哪条规则不会静默排队便于定位是 Token、成本还是窗口规则触顶。Q2窗口到期后额度怎么恢复惰性重置下一次请求自动推进重置点并清零计数无需重启服务。Q3能限制客户端的请求强度吗可以。密钥还支持enforced_reasoning_effort强制推理强度和allowed_reasoning_efforts允许列表越界请求返回403 reasoning_effort_not_allowed详见 api-keys.md 的 Reasoning effort policies 一节。Q4成本规则按什么价格算按请求实际使用的模型 × Token 数估算扣减未知模型走保守兜底单价确保预算不被绕过。总结codex-lb 的API 密钥限流把谁在用账号绑定、用什么模型管控、用多少Token/成本、多久重置时间窗五个问题收敛到一张密钥卡片里。作为多账号负载均衡代理这套5 维限流机制让团队配额管理像配置防火墙规则一样直观——上手只需在API Keys → Create中勾选几下即可开始精细化控制每一次 Codex 调用的成本 【免费下载链接】codex-lbCodex/ChatGPT multiple account load balancer proxy with usage tracking, dashboard, and OpenCode-compatible endpoints项目地址: https://gitcode.com/gh_mirrors/co/codex-lb创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考