热核算力

GPT API / 请求排查

401、403、404、429、503 怎么查

先看响应里的 error.code 或 error.message,再定位密钥、分组、模型或临时限流。同一个 HTTP 状态可能对应不同原因。

先做三项核对

  1. 确认请求地址

    正式 Base URL 为 https://api.codexhot.com/v1。健康检查返回 200 只说明入口在线,不代表某个模型可用。

  2. 确认密钥与分组

    在请求头使用 Authorization: Bearer YOUR_API_KEY,核对该密钥绑定的分组。不要把密钥放进 URL 或发给客服。

  3. 确认模型与余额

    先查看密钥可见的模型列表与当前余额,再发送短请求;真实推理可能产生费用。

按返回内容定位

以下是常见情况,不要仅凭状态码判断原因。优先阅读响应体中的具体错误内容。

状态常见提示下一步
401API_KEY_REQUIRED 或 INVALID_API_KEY检查请求头是否带 Bearer 密钥、密钥是否完整有效。不要在 URL 查询参数里传密钥。
403密钥未分配到可调度分组在控制台查看密钥所属分组;若确实未分组,联系管理员处理。其他 403 应按响应文字继续定位。
404Model ... is not available for this group 或 model_not_found对照密钥分组的模型清单,检查模型名拼写。白名单之外的模型不能靠重复请求恢复。
429gateway_concurrency_limit、gateway_queue_full、API_KEY_QUOTA_EXHAUSTED 或上游限频并发或排队已满时降低同时请求数并稍后重试;密钥额度耗尽时核对余额和密钥限制。若提示上游限频,等待恢复或联系支持确认。
503Service temporarily unavailable当前没有可调度账号等情况可能触发此错误。稍后重试;持续出现时附上请求时间和模型名联系支持。

先用模型列表自检

使用自己的密钥读取模型列表,不发起模型推理。若这里就返回 401 或 403,先解决密钥和分组问题;若列表可用,再按分组模型清单核对要调用的模型。

curl -i https://api.codexhot.com/v1/models \
  -H 'Authorization: Bearer YOUR_API_KEY'

不要在公开截图、群聊或工单中贴出完整密钥。模型列表请求也需要有效密钥,并可能受到平台访问限制。

为什么健康检查成功,推理仍会失败?

健康检查只确认服务入口可响应。密钥状态、分组白名单、账号额度和并发限制都要在具体请求时判断。先看错误正文,再决定是改请求、等待还是联系支持。

联系客服时提供什么?

提供请求时间、调用的模型、所选分组、HTTP 状态和错误代码即可;不要发送 API Key、完整请求头或包含敏感内容的请求体。官网客服 QQ 群:1106148284。

重新确认模型和请求格式

从当前可用模型开始,先跑通一条短请求,再逐步增加并发。