Verbindungsanleitungen

Detaillierte Einrichtungsanleitungen für SDKs, Codierungsagenten, IDEs und OpenAI-kompatible Clients.

Wählen Sie den Client aus, den Sie verwenden:

Erstellen Sie einen API-Schlüssel im Modell Gate-Bedienfeld. Der vollständige Schlüssel wird nur einmal angezeigt.

Zugang zum Spielplatz

Offen Spielplatz im Kontomenü, um den Request Builder oder die Modellüberprüfung zu verwenden. In Unternehmensprofilen bleibt der Abschnitt sichtbar, während die Modell-API aktiviert ist, auch wenn noch kein verwendbarer Schlüssel zugewiesen wurde. Eine Setup-Seite erläutert fehlende Kontoverifizierungen, Unternehmensaktivierungen, Schlüsselberechtigungen oder API-Endpunktkonfiguration und bietet zulässige Verwaltungslinks und Support. Durch einfaches Öffnen von Playground erfolgt keine kostenpflichtige Anfrage und es wird kein Schlüssel erstellt.

Anfragen erfordern einen zulässigen aktiven Schlüssel. Ein projektgebundener Schlüssel muss zum aktuellen Unternehmen und einem aktiven Projekt gehören. Mit Entwickler- oder Administrator-Ausführungszugriff kann ein Mitglied gemeinsame Projektanmeldeinformationen in Playground verwenden, ohne sein permanentes Geheimnis zu erhalten. Die Browsersitzung stellt das angemeldete Mitglied dar, nicht den Verwalter des Schlüssels. Die alleinige Betrachtung der Nutzung garantiert keine Ausführung. Wenn die Model-API für eine Domäne deaktiviert ist, sind auch deren Playground-Routen nicht verfügbar. Das temporäre Passwort und die erforderliche Zwei-Faktor-Einrichtung haben weiterhin Vorrang.

Das Panel verwendet den konfigurierten API-Endpunkt seines aktuellen Domänenprofils. Es wird nicht zur API eines anderen Projekts gewechselt, wenn eine Bindung fehlt. Der Schlüsselwähler zeigt die rücksetzbare Nutzung im Vergleich zum konfigurierten Ausgabenlimit an; Lebenszeitausgaben sind nicht dieser Zähler. Aktuelle Schlüssel-/Projektlimits und Unternehmenssaldo werden vor der Ausgabe einer kurzlebigen Sitzung überprüft, und die API bleibt für die Live-Zulassung und -Abrechnung maßgebend. Ein Einfrieren des Projekts oder eine Berechtigungsänderung nach dem Laden der Seite kann dazu führen, dass der zuvor ausgewählte Schlüssel nicht mehr verfügbar ist. Aktualisieren Sie die Seite nach einer autorisierten Korrektur.

Multimodale Anfrageformate

Der Builder folgt denselben Fähigkeitsverträgen, die auch von Administratormodell-Probes verwendet werden. OpenAI-kompatible Bildgenerierung verwendet /v1/responses mit dem gehosteten image_generation Werkzeug; das erzeugte image_generation_call.result wird dekodiert und als Bildartefakt angezeigt. OpenAI Responses PDF-Eingabe verwendet eine input_file Inhaltselement mit einem vollständigen data:application/pdf;base64,... Wert in file_data. Anthropic Messages PDF-Eingabe verwendet eine native document blockieren mit source.type=base64, media_type=application/pdf und die nackten Base64-Bytes. Der Browser liest ausgewählte Dateien lokal und sendet sie direkt an den konfigurierten Model API-Endpunkt; Das Panel lädt sie nicht zuerst hoch. Der Builder bewirbt Chat-Abschlüsse nicht als PDF-Format. Roh-JSON bleibt für anbieterspezifische Verträge außerhalb dieser getesteten Formen verfügbar.

Überprüfung des Browsermodells

/chat/verify vergleicht einen Endpunkt mit einem Bereitschaftspunkt Verhaltensreferenz des ausgewählten kanonischen Modells. Die aktuelle Methode ist model-verification-behavioral-reference-v2.0. Es handelt sich hierbei weder um eine Anbieterbescheinigung noch um einen Anspruch auf Schulungsnachweise.

Fertige Referenz, keine Recherchephase

Administratoren aktivieren separat einen kostenpflichtigen Referenzsammler über eine explizit vertrauenswürdige Route. Es liest fertige Monate aus der bestehenden Fragendatenbank, mit standardmäßig zehn bewerteten Beobachtungen pro Frage und bis zu zwanzig verschiedenen Fragen pro Sammlungsanforderung. Versäumnisse des Anbieters und unbewertete/fehlende Antworten sind keine Beobachtungen von Unwissenheit. Administrative Antworten und Überarbeitungen werden zur Einsichtnahme aufbewahrt; Benutzerausführungen tragen niemals automatisch zu dieser vertrauenswürdigen Referenz bei.

Eine Referenz muss sechzehn aufeinanderfolgende abgeschlossene Monate auf beiden Seiten eines stabil beobachteten RECALL-Ankers abdecken. Pro Monat werden zwei geeignete Tatsachen ausgewählt, wobei eine normalerweise korrekte und eine normalerweise nicht korrekte Tatsache bevorzugt werden, wenn beide vorhanden sind. ansonsten zwei der verfügbaren stabilen Kategorie. Ein Formatkontrollanruf mit 32 Fragen muss vom Richter angenommen werden, bevor die Referenz fertig wird. Die aktivierte automatische Sammlung stellt sie unter der gemeinsamen API-Aufrufautorisierung in die Warteschlange; Ältere manuelle Profile behalten ihre explizite Kontrollwirkung. Offizielle Cutoff-Metadaten bleiben getrennt. Ein unveröffentlichter offizieller Cutoff löst niemals eine Recherche während eines Benutzerlaufs aus. Keine fertige Referenz oder unvollständige Abdeckung bedeutet, dass das Modell noch nicht getestet werden kann.

Eine geprüfte Anfrage und ein Vordergrundrichter

Wählen Sie eine fertige Referenz und einen berechtigten Model Gate-Schlüssel für die Evaluierungsabrechnung aus. Die Referenz enthält das Protokoll, das kanonische Modell und den genauen Anforderungsvertrag. Neue Verwendung automatischer Referenzen minimal-v1: Chat sendet nur Modell + eine Benutzernachricht, Antworten nur Modell + Eingabe und Anthropic Messages sendet zusätzlich die erforderlichen max_tokens=4096. Historische Referenzen behalten ihre gespeicherten Legacy-Optionen. Der Browser stellt eine Anfrage mit 32 Fragen zu Ihrem ausgewählten HTTPS-Endpunkt. Der externe Schlüssel verbleibt nur im Browserspeicher; Es wird niemals an den Model Gate-Anwendungsserver gesendet oder im lokalen/Sitzungsspeicher gespeichert. CORS muss diese Browseranforderung zulassen. Das getestete Modell erhält Fragen und geschlossene Anweisungen, niemals den Antwortschlüssel, Referenzantworten, positive/negative Bezeichnungen oder erwartete Fehler.

In diesem Lebenszyklus gibt es keine Cutoff-Suche, keine gehostete Suche, keine Bankauffüllung oder keine Fragengenerierung. Die Auswahl lokaler Snapshots ist kein kostenpflichtiger Generierungsaufruf. Der externe Anbieter kann für seine Anfrage eine Gebühr erheben; Der Vordergrundrichter verwendet den ausgewählten berechtigten Model Gate-Berechtigungsnachweis. Lassen Sie die Registerkarte geöffnet. Die Live-Bühnenanzeige zeigt die verstrichene Zeit und die tatsächliche Arbeit an; Während eine Verifizierung aktiv ist, warnt der Browser vor dem Schließen, Neuladen oder Navigieren. Dadurch wird die Anfrage nicht im Hintergrund fortgesetzt. Beim erneuten Versuch einer unvollständigen Auswertung wird die noch im Browser gespeicherte Antwort verwendet, keine zweite Anfrage nach dem getesteten Modell. Ein unsicherer Anruf wird nicht automatisch wiederholt.

Der Browser streamt die Antwortanfrage des Vordergrundrichters direkt durch api.model-gate.com, ohne gehostete Suche. Der mehrminütige Richterstrom wird nicht durchgehend offen gehalten panel.model-gate.com. Ausgenommen bleiben automatische Formatprüfungen und der alte Instruction Following Score; Die semantische Beurteilung obliegt ausschließlich dem Richter.

Korrespondenz nur für Richter

Der Richter erhält die aktuellen Antworten, die richtigen Antworten und alle gruppierten Referenzbeobachtungen zu den ausgewählten 32 Sachverhalten, einschließlich widersprüchlicher Beobachtungen und deren Vielfältigkeit. Es bewertet die Korrektheit, das erklärte RECALL-/INFERENCE-/GUESS-/UNKNOWN-Verhalten und Abweichungen in beide Richtungen. Unerwartete richtige Antworten auf normalerweise ungelöste Referenzfragen können die Korrespondenz verringern; Tatsächlich richtige Antworten werden nicht in falsch umbenannt. Der Richter allein weist den Korrespondenzwert, die Kategorie der Identitätsfeststellung, das Vertrauen, die Gründe und die Einschränkungen zu. Der Server validiert die Berichtsstruktur und zählt gespeicherte Beobachtungen, wendet jedoch keinen semantischen Schwellenwert, keine Strafe, keine gewichtete Bewertung oder keine Ersatzschlussfolgerung an.

Eine hohe Punktzahl ist keine Wahrscheinlichkeit für eine exakte Modellidentität. Der Bericht kann weder den Preis noch das Schulungsdatum eines Modells ermitteln. Der gespeicherte Snapshot und der Benchmark identifizieren genau, was verglichen wurde. Alte Berichte der Version 1.7 behalten ihre ursprüngliche Methode bei und werden nicht mit Beweisen der Version 2 zusammengeführt. Aus den V2-Ergebnissen wird kein automatischer Community-Identitätsausweis berechnet.

Berichte und Datenschutz

Der Live-Trace zeigt die Anfrage, die vom Browser gehaltene Antwort, die Auswertungsnutzlast und die Richterausgabe ohne Anmeldeinformationen. Bei einer privaten Ausführung wird nicht die vollständige Rohantwort des Anbieters oder die wörtlich sichtbare Antwort pro Frage für die Browserwiederherstellung gespeichert. Es bleiben normalisierte Noten, Erläuterungen und unveränderliche Referenzkennungen bestehen. Bei der Veröffentlichung handelt es sich um eine gesonderte ausdrückliche Einwilligung. Veröffentlichte v2-Berichte zeigen die gespeicherte Beurteilung des Richters an, ohne dass eine weitere Bewertung oder serverseitige Neubewertung durchgeführt werden muss. Antworten auf administrative Referenzen haben im Gegensatz zu gewöhnlichen Browser-Antworten einen eigenen beibehaltenen/überwachten Lebenszyklus.

Anforderungskompatibilität und Anbieterfehler (10.28.1)

Die Überprüfungsanforderung „Chat-Abschlüsse“ fügt die vollständigen Anweisungen zum geschlossenen Buch und alle Fragen der Reihe nach in einer Benutzernachricht zusammen. Dadurch wird vermieden, dass ein OpenAI-kompatibles Gateway eine Systemrolle übersetzen muss, wenn es an ein Backend im Anthropic-Stil weiterleitet. Das ausgewählte Protokoll und der genaue Endpunkt bleiben maßgeblich: Es gibt keinen modellnamenbasierten Protokollwechsel, keine zusätzliche Anforderung getesteter Modelle oder eine allgemeine Proxy-Konvertierung. Native Anthropic Messages verwendet immer noch die oberste Ebene system mit einer Benutzernachricht; Responses behält seine kanonischen Benutzereingaben bei. Der Trace zeigt den tatsächlichen ausgehenden JSON. Die etablierte Transportkompatibilität bleibt erhalten. Behavioral-Reference v2 stellt eine angeheftete Anfrage mit 32 Fragen bereit, ohne die One-Tested-Model-Request-Regel zu ändern.

Bei Nicht-2xx-Antworten handelt es sich um HTTP-Fehler, nicht um unerkannte erfolgreiche Umschläge. Ein Root-Provider-Fehler wird gemeldet als Fehlerumschlag des Anbieters, auch wenn sie mit HTTP 200 zurückgegeben werden. Solche Fehler liefern nie Modellantworten, erreichen nie die Beurteilung durch den Richter und können nicht durch erneutes Versuchen der Auswertung derselben Antwort repariert werden. Protokollkompatibilität ist NOT_ASSESSED für eine Fehlerantwort. Jede ausgeführte externe Anfrage kann dennoch kostenpflichtig sein; Die lokale Referenzauswahl führt zu keinem Generatoraufruf. Rohe Anbieterfehler bleiben eine browserlokale Diagnose und kein öffentlicher Berichtsinhalt. Bei einem generischen Model Gate-Upstream-Fehler wird die nur für Administratoren vorgesehene rohe Upstream-Meldung absichtlich nicht angezeigt.

Automatische Referenzverwaltung

Administratoren konfigurieren einmalig die automatische Referenzsammlung für berechtigte bestehende und zukünftige Katalogmodelle. Es werden die konfigurierte Model Gate-API-Verbindung und der Administratorschlüssel verwendet, mit gemeinsamen täglichen/lebenslangen API-Aufruflimits und ohne separates automatisches USD-Reservierungsbudget. Models benötigen einen offiziellen Cutoff oder eine separat beschaffte inoffizielle Schätzung, um die Sammlung zu verankern. Der Mitarbeiter recherchiert nicht nach fehlenden Daten und stellt auch keine Fragen. Der anfängliche Standardwert beträgt weiterhin zehn nutzbare Beobachtungen pro Frage und höchstens zwanzig verschiedene Fragen pro Erhebungsanfrage. Verweise auf ältere Handbücher bleiben getrennt.

Die Referenz ist ein Beweis für das konfigurierte Verhalten und kein Beweis dafür, welcher Anbieter eine Anfrage ausgeführt hat. Nicht geeignete oder mehrdeutige Routen bleiben nicht verfügbar, bis der Administrator das Routing auflöst. Nur der Richter beurteilt die Korrespondenz.

Nicht unterstützte API-Pfade werden jetzt zurückgegeben 404 endpoint_not_supported mit dem angeforderten Pfad; Es wird eine falsche Methode auf einem unterstützten Pfad zurückgegeben 405 method_not_allowed Und Allow. Einheimisch /v1/balance ist unverändert; /v1/user/balance ist nicht implementiert. Teilen Sie die zurückgegebene Anforderungs-ID mit, niemals Ihren API-Schlüssel, wenn Sie diese Fehler melden.