API
Une référence complète de l'API Model Gate en cinq minutes.
API
Model Gate expose deux interfaces d'inférence compatibles :
- Anthropique —
POST /v1/messagespour le SDK Anthropic, Claude Code et les clients compatibles. - OpenAI —
POST /v1/chat/completionspour le SDK OpenAI et les clients compatibles.
Un mg_live_... La clé fonctionne dans les deux modes. Le routage et la facturation sont gérés par Model Gate.
URL de base
https://api.model-gate.com
Les clients compatibles OpenAI utilisent normalement https://api.model-gate.com/v1.
Démarrage rapide
boucle : Anthropique
curl https://api.model-gate.com/v1/messages \
-H "x-api-key: mg_live_..." \
-H "anthropic-version: 2023-06-01" \
-H "content-type: application/json" \
-d '{"model":"claude-opus-4.8","max_tokens":1024,"messages":[{"role":"user","content":"Hello"}]}'
boucle : OpenAI
curl https://api.model-gate.com/v1/chat/completions \
-H "Authorization: Bearer mg_live_..." \
-H "content-type: application/json" \
-d '{"model":"claude-opus-4.8","messages":[{"role":"user","content":"Hello"}]}'
Python : SDK OpenAI
from openai import OpenAI
client = OpenAI(api_key="mg_live_...", base_url="https://api.model-gate.com/v1")
response = client.chat.completions.create(model="claude-opus-4.8", messages=[{"role":"user","content":"Hello"}])
print(response.choices[0].message.content)
Python : SDK anthropique
from anthropic import Anthropic
client = Anthropic(api_key="mg_live_...", base_url="https://api.model-gate.com")
response = client.messages.create(model="claude-opus-4.8", max_tokens=1024, messages=[{"role":"user","content":"Hello"}])
print(response.content[0].text)
Capacités prises en charge
Le streaming, la mise en cache des invites, la vision, l'utilisation d'outils/appels de fonctions, la réflexion étendue et les modèles à grand contexte sont transmis lorsqu'ils sont pris en charge par le modèle sélectionné.
Limites
Le RPM et la concurrence peuvent être configurés par compte et par clé. Une clé dispose également d'un compteur d'utilisation des dépenses réinitialisable et d'une durée de vie total_spent comptoir. Le dépassement d’une limite de taux rapporte 429 avec Retry-After.