チャレンジ
管理者が選択した固定の評価者は、隠された回答キーを持つ 1 つのコンパクトな課題を作成します。
外部 AI API に対して単一リクエストの動作フィンガープリントを実行します。 Model Gate がチャレンジを作成し、ブラウザーが外部エンドポイントを直接呼び出し、固定の評価者が応答をスコアリングします。
External endpoint
↓ browser AJAX
one transparent generated challenge
↓
behavioral fingerprint
↓
Model Gate judge
↓
score + identity signalsこのテストは、経時的な事実の想起、自己報告の一貫性、棄権行動、信頼度の調整、厳密に構造化された出力コンプライアンスを組み合わせたものです。 API によって返されたモデル名はメタデータとして記録され、証拠としては扱われません。
管理者が選択した固定の評価者は、隠された回答キーを持つ 1 つのコンパクトな課題を作成します。
ブラウザはチャレンジを外部 HTTPS エンドポイントに直接送信します。外部 API キーが Model Gate に送信されることはありません。
Model Gate は返された回答を評価し、再現率、最新性、幻覚耐性、キャリブレーション、および指示に従っているスコアを計算します。
ここにエンドポイントが表示されるのは、少なくとも 3 つの異なる Model Gate アカウントが 30 日以内に、平均スコアが少なくとも 80 でスコアの分散が低いテストを公開した場合に限られます。
| 終点 | 主張されているモデル | プロトコル | 評価者 | 平均点 | 独立したテスター | 最後にテストした |
|---|---|---|---|---|---|---|
| 十分な独立した公開テストを備えたエンドポイントはまだありません。 | ||||||
deepseek-v4-flashhttps://api.model-gate.com/v1/chat/completions
deepseek-v4-flashhttps://api.model-gate.com/v1/chat/completions