モデルの価格

現在有効なモデルと米ドル価格

Pricing is informational. An individual price may be configured for each individual account.
Input-token caching and routed requestsBecause Model Gate can route requests across available upstream capacity, provider-side input-token or prompt caching may work, but it is not guaranteed for every request. When deterministic cache affinity is important, use a direct provider API account or a direct API key.

すべての価格は 100 万トークンあたりの米ドルで表示されます。このテーブルは、管理パネルで有効なモデルから生成されます。

ModelInputOutputCache readCache writeReasoning
claude-opus-5$4$20$0.4$5$20
claude-sonnet-5$1.6$8$0.16$2$1.6
deepseek-v4-flash$0.112$0.224$0.0022$0.112$0.224
deepseek-v4-pro$0.348$0.696$0.0029$0.348$0.696
gpt-5.6-luna$0.16$0.32$0.16$0.2$0.16
gpt-5.6-sol$4$24$0.4$5$24
gpt-5.6-terra$1.6$9.6$0.16$2$9.6
gpt-6-astra$8$40$0.8$9.6$40
kimi-k2.7-code$1.52$6.4$0.304$1.52$6.4
kimi-k3$2.4$12$0.24$2.4$12
mimo-v2.5$0.12$0.24$0.032$0.12$0.24
mimo-v2.5-pro$0.36$0.72$0.032$0.36$0.72
minimax-m3$0.36$1.44$0.072$0.36$1.44
qwen3.7-max$2$6$2$2$6
qwen3.7-plus$0.96$3.84$0.96$0.96$3.84
claude-opus-4-6$4$20$0.4$5$20
claude-opus-4-7$4$20$0.4$5$20
claude-opus-4-8$4$20$0.4$5$20
claude-sonnet-4-6$2.4$12$0.24$3$12
deepseek-v4.1-flash$0.12$0.48$0.024$0.12$0.48
gpt-5.4$2$12$0.2$3$12
gpt-5.5$4$24$0.4$4.8$24
qwen3.8-flash$0.12$0.376$0.0128$0.16$0.376
qwen3.8-max$1.6$4.8$0.2$2$4.8

通常の表は同期とネイティブを示します。 async=true 価格設定。価格設定テンプレートに 以外のバッチ リクエスト価格係数がある場合、 1を選択すると、ページの表の上にその係数が表示されます。これは、Model Gate によって実行される Claude/OpenAI 互換のバッチ項目にのみ適用されます。

あなたのアカウントカタログ

認証された モデル このページには、100 万プロバイダー トークンあたりの入力、出力、およびキャッシュの読み取り価格が米ドルで示されたコンパクトな行が表示されます。表示されるアカウントレートには、アカウントに適用される価格設定が含まれます。公式プロバイダーの参照は情報提供であり、引き落とされる金額ではありません。公定価格は、アカウントレートが低い場合にのみ取り消し線が適用されます。欠落している参照は、ゼロ価格ではなく不明として表示されます。

名前、モデル ID、またはプロバイダーで検索したり、プロバイダー/機能で絞り込んだり、出力価格で並べ替えたりできます。 詳細 モデルのコンテキスト制限、アドバタイズされた機能、モダリティ、およびキャッシュ書き込みと推論を含む完全な 5 つのカテゴリのレート テーブルが開きます。不足している制限は「未公開」のままです。詳細テーブルの価格は、保存されている小数精度を保持します。個々のアカウントには、設定されたトークンの表示係数も表示されます。ビジネスアカウントでは米ドル価格が維持されます。