ワークロード計算機
LLM API コスト計算機
トークン数、リクエスト数、キャッシュ再利用、バッチ料金から月額 API コストを概算します。プリセットから始めるか、カスタム入力で利用量を設定できます。
利用量入力
1リクエストあたりのトークン数、リクエスト数、キャッシュ再利用、対応するバッチ料金からワークロードを見積もります。
入力
テキストから入力トークンを見積もる
テキストはブラウザ内だけで処理され、保存・送信されません。o200k_base による参照値であり、選択中のモデルやプロバイダーの正確な請求トークン数ではありません。API のメッセージ構造、ツール、スキーマ、画像などの追加トークンも含みません。
詳細オプション
このページのコスト概算は 2026/09/19 に生成されたモデルデータベースを使います。料金、ライフサイクル、機能項目は不完全またはプロバイダー固有の場合があるため、本番利用前には公式プロバイダーで確認してください。
このページの使い方
予算見積もりはプリセットから始め、プロダクトの利用量に合わせてトークン数とリクエスト数を調整します。実行済みのリクエストやセッションのトークン合計がある場合は、実績トークンを使うを選んで内訳を直接入力できます。
料金の計算方法
コストは (トークン数 ÷ 1,000,000) × 100万トークンあたりの単価 で計算します。入力トークンと出力トークンは別々に料金が設定されており、出力は通常3〜5倍高額です。キャッシュヒット率は、一致したリクエストに低いキャッシュ単価を適用することで有効な入力コストを削減します。計算式: 合計 = (入力トークン × 入力単価 + 出力トークン × 出力単価) × リクエスト数 × (1 − キャッシュ割引)。
チャットボット、RAG、要約、コーディングエージェントの入力例を見てから、下の項目を調整できます。
サブスクリプションで足りる場合と、従量課金の API 料金を見るべき場合を確認できます。
OpenAI、Anthropic、Google、Mistral、DeepSeek の最安チャット、ミッドレンジ、推論モデルの料金を比較できます。
MMLU、GPQA、HumanEval などのベンチマークスコアをプロバイダー別に比較し、料金以外のモデル品質を確認できます。
2〜3 つのモデルを並べて、料金、コンテキストウィンドウ、モダリティ、機能を比較できます。