GPT API / 请求排查
401、403、404、429、503 怎么查
先看响应里的 error.code 或 error.message,再定位密钥、分组、模型或临时限流。同一个 HTTP 状态可能对应不同原因。
先做三项核对
- 确认请求地址
正式 Base URL 为
https://api.codexhot.com/v1。健康检查返回 200 只说明入口在线,不代表某个模型可用。 - 确认密钥与分组
在请求头使用
Authorization: Bearer YOUR_API_KEY,核对该密钥绑定的分组。不要把密钥放进 URL 或发给客服。 - 确认模型与余额
先查看密钥可见的模型列表与当前余额,再发送短请求;真实推理可能产生费用。
按返回内容定位
以下是常见情况,不要仅凭状态码判断原因。优先阅读响应体中的具体错误内容。
| 状态 | 常见提示 | 下一步 |
|---|---|---|
| 401 | API_KEY_REQUIRED 或 INVALID_API_KEY | 检查请求头是否带 Bearer 密钥、密钥是否完整有效。不要在 URL 查询参数里传密钥。 |
| 403 | 密钥未分配到可调度分组 | 在控制台查看密钥所属分组;若确实未分组,联系管理员处理。其他 403 应按响应文字继续定位。 |
| 404 | Model ... is not available for this group 或 model_not_found | 对照密钥分组的模型清单,检查模型名拼写。白名单之外的模型不能靠重复请求恢复。 |
| 429 | gateway_concurrency_limit、gateway_queue_full、API_KEY_QUOTA_EXHAUSTED 或上游限频 | 并发或排队已满时降低同时请求数并稍后重试;密钥额度耗尽时核对余额和密钥限制。若提示上游限频,等待恢复或联系支持确认。 |
| 503 | Service temporarily unavailable | 当前没有可调度账号等情况可能触发此错误。稍后重试;持续出现时附上请求时间和模型名联系支持。 |
先用模型列表自检
使用自己的密钥读取模型列表,不发起模型推理。若这里就返回 401 或 403,先解决密钥和分组问题;若列表可用,再按分组模型清单核对要调用的模型。
curl -i https://api.codexhot.com/v1/models \
-H 'Authorization: Bearer YOUR_API_KEY'
不要在公开截图、群聊或工单中贴出完整密钥。模型列表请求也需要有效密钥,并可能受到平台访问限制。
为什么健康检查成功,推理仍会失败?
健康检查只确认服务入口可响应。密钥状态、分组白名单、账号额度和并发限制都要在具体请求时判断。先看错误正文,再决定是改请求、等待还是联系支持。
联系客服时提供什么?
提供请求时间、调用的模型、所选分组、HTTP 状态和错误代码即可;不要发送 API Key、完整请求头或包含敏感内容的请求体。官网客服 QQ 群:1106148284。
热核算力