异步请求

对推理请求进行排队并通过面板 API 检索结果。

异步请求

相同的推理端点支持同步和异步执行。添加 "async": truePOST /v1/messages 或者 POST /v1/chat/completionshttps://api.model-gate.com

{"model":"claude-sonnet-4.6","messages":[{"role":"user","content":"Analyze this document"}],"async":true}

网关返回 202 Accepted:

{
  "request_id":"01J...",
  "status":"queued",
  "result_url":"https://panel.model-gate.com/api/v1/requests/01J..."
}

request_id 是公共请求标识符。它也返回在 X-Request-ID

仅使用配置文件中的帐户级 API 密钥通过面板 API 检索结果:

curl https://panel.model-gate.com/api/v1/requests/01J... 
  -H "Authorization: Bearer mg_partner_..."

排队或正在处理的请求返回其当前状态。已完成的请求返回 response_status, response_headers, 和 response。失败的请求还会返回 error 目的。未知、外来和过期的请求 ID 全部返回 404

用于推理的模型 API 密钥无法检索异步结果。账户级API KEY无法调用模型。

当配置文件中配置了回调 URL 时,完成的结果也会传递到那里。即使启用了回调,通过面板 API 进行的轮询仍然可用。

存储警告: 请求和响应暂时存储在 Model Gate 数据库中。异步记录将在 24 小时后删除。对于不得临时存储的数据,不要使用异步模式。

回调签名使用 X-Model-Gate-Signature: t=<unix>,v1=<hmac_sha256>,签署确切的字符串 <timestamp>.<raw_body> 使用配置文件中的回调秘密。

回调

完成的异步结果可以传递到配置文件中配置的回调 URL。看 回调 用于签名验证、重试、安全性和幂等性指导。