nscale
Qwen2.5-Coder-3B-Instruct
この条件での推定月額 API コストは $1.40 です。 掲載コンテキスト上限は N/A です。
モデル詳細を開くデータから見る記事
サポート用チャットボットの API コストは、コーディングエージェントや長い文脈を使う RAG とは違う形で増えます。 このページでは条件を 1 つに絞り、入力 500 token、出力 300 token、1 ユーザーあたり月 100 メッセージ、月間 1,000 ユーザーで見積もります。
シナリオ
数値は、このサイトの現在の価格データから生成しています。請求額は、キャッシュ、割引、リージョン、利用量ティア、提供元ごとの課金ルールによって変わる場合があります。
短いユーザーメッセージと直近の会話文脈を想定します。
サポート回答やプロダクト内の返答として、短く返す想定です。
月内に繰り返し使われるサポート用途として見ます。
合計 100,000 メッセージです。
コスト確認
表は月間 API コスト見積もりの安い順です。本番候補として扱う前に、各モデルページと提供元の料金ページを確認してください。
| モデル | コンテキスト | 入力 / 100万token | 出力 / 100万token | 月額コスト |
|---|---|---|---|---|
| Qwen2.5-Coder-3B-Instruct nscale | N/A | $0.0100 / 1M tokens | $0.0300 / 1M tokens | $1.40 |
| Qwen2.5-Coder-7B-Instruct nscale | N/A | $0.0100 / 1M tokens | $0.0300 / 1M tokens | $1.40 |
| Qwen2.5-Coder-7B nebius | 32.8K | $0.0100 / 1M tokens | $0.0300 / 1M tokens | $1.40 |
| llama3.2-11b-vision-instruct lambda_ai | 131.1K | $0.0150 / 1M tokens | $0.0250 / 1M tokens | $1.50 |
| llama3.2-3b-instruct lambda_ai | 131.1K | $0.0150 / 1M tokens | $0.0250 / 1M tokens | $1.50 |
| Llama-3.2-3B-Instruct deepinfra | 131.1K | $0.0200 / 1M tokens | $0.0200 / 1M tokens | $1.60 |
| paddleocr-vl novita | 16.4K | $0.0200 / 1M tokens | $0.0200 / 1M tokens | $1.60 |
| Meta-Llama-3.1-8B-Instruct-Turbo deepinfra | 131.1K | $0.0200 / 1M tokens | $0.0300 / 1M tokens | $1.90 |
チャットボットの文脈が長い場合、出力が長い場合、月間セッション数が少ない場合は、計算機でトークン数を変えて見積もり直してください。
注意点
このページは回答品質、レイテンシ、安全性の挙動、ツール呼び出し、多言語対応、レート制限を順位付けしません。 低コストなチャットルートの中には、特定用途向け、利用制限付き、または一般的なサポートチャットボットに向かないものがあります。 価格候補の絞り込みとして使い、実際のモデルルートを試したうえで、最終的な料金は提供元でも確認してください。