LLM API 料金比較:GPT-6・Claude・Gemini・DeepSeek など22モデル
Jonhisking · 2026年10月2日
API 料金を公開している言語モデルは数十にのぼり、同じリクエストでもモデルによって費用が150倍も違うことがあります。この記事では、OpenAI、Anthropic、Google、xAI、DeepSeek、Mistral、Alibaba、Moonshot の人気モデル22個の現在の定価を並べ、一般的なリクエストが実際にいくらかかるか、どう選べばよいかをまとめました。
API 料金の比較
100万トークンあたりの料金です。一般的なリクエスト(入力2,000トークン、出力500トークン)の費用が安い順に並べています。最後の列は、そのリクエストを1万回送った場合の費用です。
| モデル | 入力 / 100万 | 出力 / 100万 | 1万リクエスト |
|---|---|---|---|
| GPT-5 nano | $0.05 | $0.40 | $3.00 |
| GPT-6 Luna | $0.10 | $0.50 | $4.50 |
| Qwen3.8 Flash | $0.15 | $0.47 | $5.35 |
| Mistral Small | $0.15 | $0.60 | $6.00 |
| DeepSeek V4 Flash | $0.30 | $1.20 | $12.00 |
| Gemini 3.1 Flash-Lite | $0.25 | $1.50 | $12.50 |
| GPT-5 mini | $0.25 | $2.00 | $15.00 |
| Mistral Large 3 | $0.50 | $1.50 | $17.50 |
| Gemini 3.8 Flash | $0.75 | $3.75 | $33.75 |
| Grok 4.20 | $1.25 | $2.50 | $37.50 |
| Claude Haiku 4.5 | $1.00 | $5.00 | $45.00 |
| DeepSeek V4 Pro | $1.32 | $3.96 | $46.20 |
| Mistral Medium 3.5 | $1.50 | $7.50 | $67.50 |
| Grok 4.7 | $2.00 | $6.00 | $70.00 |
| Qwen3.8 Max | $2.00 | $6.00 | $70.00 |
| GPT-6 Sol | $2.00 | $10.00 | $90.00 |
| Claude Sonnet 5.5 | $2.00 | $10.00 | $90.00 |
| Gemini 3.1 Pro | $2.00 | $12.00 | $100.00 |
| Kimi K3 | $3.00 | $15.00 | $135.00 |
| Claude Opus 5.5 | $4.00 | $20.00 | $180.00 |
| GPT-6 Astra | $10.00 | $50.00 | $450.00 |
| Claude Fable 5.1 | $10.00 | $50.00 | $450.00 |
料金は米ドル建ての定価で、2026年10月1日時点のものです(円での金額は為替レートによって変わります)。料金は頻繁に、ときには毎週のように変わるので、大きな処理を始める前には各社の公式情報で確認してください。TokenSave のトークンカウンターも同じ料金表を使っており、毎日更新しています。
3つの価格帯
格安(入力100万トークンあたり$0.50未満): GPT-5 nano、GPT-6 Luna、Qwen3.8 Flash、Mistral Small、DeepSeek V4 Flash、Gemini 3.1 Flash-Lite、GPT-5 mini。分類、情報抽出、ルーティング、短い回答など、大量に処理する用途に向いています。
中価格帯($1〜3前後): Gemini 3.8 Flash、Claude Haiku 4.5、DeepSeek V4 Pro、Grok、Mistral Medium、Qwen3.8 Max、GPT-6 Sol、Claude Sonnet 5.5、Gemini 3.1 Pro、Kimi K3。チャットアシスタント、文章作成、分析、コーディングエージェントの標準的な選択肢です。
フラッグシップ($4以上): Claude Opus 5.5、GPT-6 Astra、Claude Fable 5.1。長く複数ステップにわたるエージェント作業や難しい推論など、性能の差がはっきり示せる場面で使いましょう。
料金表だけではわからないこと
高いのは出力のほうです。 ほとんどのモデルで、出力は入力の4〜6倍の料金です。長い回答を生成するアプリなら、まず出力料金を比べてください。詳しくは出力トークンが高い理由(英語)をご覧ください。
トークナイザーが違います。 テキストをトークンに分割する方法は会社ごとに異なります。同じテキストでもモデルによってトークン数が10〜30%違うことがあるため、トークン単価が安くても請求額が安くなるとは限りません。料金表だけでなく、自分のテキストでの費用をトークンカウンターで比べてみましょう。詳しくは GPT・Claude・Gemini のトークンの数え方をどうぞ。
言語によって変わります。 英語以外のテキストはトークンを多く使います。GPT のトークナイザーでは、英語と比べて韓国語が約1.44倍、日本語が約1.79倍、チェコ語が約2倍です。日本語のプロンプトを英語で送ればトークンは約44%減り、トークンカウンターの 💸 トークン節約 ボタンを使うと、自分の端末の中でプロンプトを英語に変換できます(デスクトップ版 Chrome 138以降 / Edge 148以降)。
割引で順位が変わります。 多くの会社が、キャッシュされた入力を通常料金のごく一部で、バッチ処理を約半額で提供しています。長いプロンプトを繰り返し送るアプリでは、キャッシュをうまく使った中価格帯モデルのほうが、キャッシュなしの格安モデルより安くなることがあります。プロンプトキャッシュ(英語)とバッチ API(英語)もご覧ください。
長いプロンプトは割高になることがあります。 一定のプロンプト長を超えると高い料金がかかるモデルもあります。たとえば GPT-6 の各モデルは、入力が272,000トークンを超えるリクエストに高い料金を適用します。
いちばん安い LLM API は?
定価で見ると、上の表で最も安いのは GPT-5 nano と GPT-6 Luna で、入力100万トークンあたりそれぞれ$0.05と$0.10です。ただし大事なのは、自分のタスクに十分な品質を出せるモデルのなかで最も安いものです。実践的な進め方は次のとおりです。
- 実際の入力と期待する回答のテストケースを20〜50個用意します。
- 格安と中価格帯から2〜3個のモデルで実行します。
- 品質の基準を満たすなかで最も安いモデルを選びます。
- そのモデルが失敗するリクエストだけを、より高いモデルに回します。
自分の請求額を見積もる
実際のプロンプトをトークンカウンターに貼り付ければ、すべてのモデルでの費用を一度に確認できます。詳しい方法は AI API の請求額を見積もる方法(英語)をご覧ください。サブスクリプションと API のどちらが得かは、サブスク vs API 計算機で比べられます。
プロンプトを貼り付けて、GPT-6 各モデル・Claude・Gemini のトークンと費用を比べましょう。
トークンカウンターを開く →