API
Una referencia completa de la API de Model Gate en cinco minutos.
API
Model Gate expone dos interfaces de inferencia compatibles:
- antrópico —
POST /v1/messagespara Anthropic SDK, Claude Code y clientes compatibles. - AbiertoAI —
POST /v1/chat/completionspara OpenAI SDK y clientes compatibles.
Uno mg_live_... La tecla funciona en ambos modos. El enrutamiento y la facturación están a cargo de Model Gate.
URL base
https://api.model-gate.com
Los clientes compatibles con OpenAI normalmente utilizan https://api.model-gate.com/v1.
Inicio rápido
rizo: antrópico
curl https://api.model-gate.com/v1/messages \
-H "x-api-key: mg_live_..." \
-H "anthropic-version: 2023-06-01" \
-H "content-type: application/json" \
-d '{"model":"claude-opus-4.8","max_tokens":1024,"messages":[{"role":"user","content":"Hello"}]}'
rizo: OpenAI
curl https://api.model-gate.com/v1/chat/completions \
-H "Authorization: Bearer mg_live_..." \
-H "content-type: application/json" \
-d '{"model":"claude-opus-4.8","messages":[{"role":"user","content":"Hello"}]}'
Python: SDK de OpenAI
from openai import OpenAI
client = OpenAI(api_key="mg_live_...", base_url="https://api.model-gate.com/v1")
response = client.chat.completions.create(model="claude-opus-4.8", messages=[{"role":"user","content":"Hello"}])
print(response.choices[0].message.content)
Python: SDK antrópico
from anthropic import Anthropic
client = Anthropic(api_key="mg_live_...", base_url="https://api.model-gate.com")
response = client.messages.create(model="claude-opus-4.8", max_tokens=1024, messages=[{"role":"user","content":"Hello"}])
print(response.content[0].text)
Capacidades admitidas
La transmisión, el almacenamiento en caché de avisos, la visión, el uso de herramientas/llamada de funciones, el pensamiento extendido y los modelos de contexto grande se pasan cuando el modelo seleccionado los admite.
Límites
El RPM y la simultaneidad se pueden configurar por cuenta y por clave. Una clave también tiene un contador de uso de gastos reiniciable y una vida total_spent encimera. Devoluciones que exceden un límite de tasa 429 con Retry-After.