API
Pełna dokumentacja API Model Gate w pięć minut.
API
Model Gate udostępnia dwa kompatybilne interfejsy wnioskowania:
- Antropiczny —
POST /v1/messagesdla Anthropic SDK, Claude Code i kompatybilnych klientów. - OpenAI —
POST /v1/chat/completionsdla pakietu OpenAI SDK i kompatybilnych klientów.
Jeden mg_live_... klawisz działa w obu trybach. Routingiem i rozliczeniami zajmuje się Model Gate.
Bazowy adres URL
https://api.model-gate.com
Zwykle korzystają z nich klienci kompatybilni z OpenAI https://api.model-gate.com/v1.
Szybki start
curl: antropiczny
curl https://api.model-gate.com/v1/messages \
-H "x-api-key: mg_live_..." \
-H "anthropic-version: 2023-06-01" \
-H "content-type: application/json" \
-d '{"model":"claude-opus-4.8","max_tokens":1024,"messages":[{"role":"user","content":"Hello"}]}'
curl: OpenAI
curl https://api.model-gate.com/v1/chat/completions \
-H "Authorization: Bearer mg_live_..." \
-H "content-type: application/json" \
-d '{"model":"claude-opus-4.8","messages":[{"role":"user","content":"Hello"}]}'
Python: SDK OpenAI
from openai import OpenAI
client = OpenAI(api_key="mg_live_...", base_url="https://api.model-gate.com/v1")
response = client.chat.completions.create(model="claude-opus-4.8", messages=[{"role":"user","content":"Hello"}])
print(response.choices[0].message.content)
Python: Antropiczny SDK
from anthropic import Anthropic
client = Anthropic(api_key="mg_live_...", base_url="https://api.model-gate.com")
response = client.messages.create(model="claude-opus-4.8", max_tokens=1024, messages=[{"role":"user","content":"Hello"}])
print(response.content[0].text)
Obsługiwane możliwości
Przesyłanie strumieniowe, buforowanie podpowiedzi, wizja, używanie narzędzi/wywoływanie funkcji, myślenie rozszerzone i modele wielkokontekstowe są przekazywane, jeśli są obsługiwane przez wybrany model.
Granice
RPM i współbieżność można skonfigurować dla każdego konta i klucza. Klucz ma również resetowalny licznik zużycia wydatków i żywotność total_spent lada. Przekroczenie limitu stawki powraca 429 z Retry-After.