API

Uma referência completa da API Model Gate em cinco minutos.

API

Model Gate expõe duas interfaces de inferência compatíveis:

  • Antrópico - POST /v1/messages para o Anthropic SDK, Claude Code e clientes compatíveis.
  • OpenAI - POST /v1/chat/completions para o OpenAI SDK e clientes compatíveis.

Um mg_live_... tecla funciona em ambos os modos. O roteamento e o faturamento são gerenciados pelo Model Gate.

URL base

https://api.model-gate.com

Clientes compatíveis com OpenAI normalmente usam https://api.model-gate.com/v1.

Início rápido

ondulação: antrópica

curl https://api.model-gate.com/v1/messages \
  -H "x-api-key: mg_live_..." \
  -H "anthropic-version: 2023-06-01" \
  -H "content-type: application/json" \
  -d '{"model":"claude-opus-4.8","max_tokens":1024,"messages":[{"role":"user","content":"Hello"}]}'

ondulação: OpenAI

curl https://api.model-gate.com/v1/chat/completions \
  -H "Authorization: Bearer mg_live_..." \
  -H "content-type: application/json" \
  -d '{"model":"claude-opus-4.8","messages":[{"role":"user","content":"Hello"}]}'

Python: SDK OpenAI

from openai import OpenAI
client = OpenAI(api_key="mg_live_...", base_url="https://api.model-gate.com/v1")
response = client.chat.completions.create(model="claude-opus-4.8", messages=[{"role":"user","content":"Hello"}])
print(response.choices[0].message.content)

Python: SDK antrópico

from anthropic import Anthropic
client = Anthropic(api_key="mg_live_...", base_url="https://api.model-gate.com")
response = client.messages.create(model="claude-opus-4.8", max_tokens=1024, messages=[{"role":"user","content":"Hello"}])
print(response.content[0].text)

Capacidades suportadas

Streaming, cache de prompt, visão, uso de ferramenta/chamada de função, pensamento estendido e modelos de grande contexto são transmitidos quando suportados pelo modelo selecionado.

Limites

O RPM e a simultaneidade podem ser configurados por conta e por chave. Uma chave também possui um contador de uso de gastos reconfigurável e uma vida útil total_spent contador. Exceder um limite de taxa retorna 429 com Retry-After.

Próximas etapas