比較一覧(英語) · スコア 2026-10-04 時点 · 料金 2026-10-01 時点
AIモデルの性能と価格ランキング
高いモデルがいつも賢いとは限りません。このグラフは、各モデルの総合性能(Epoch Capabilities Index、ECI)とAPI料金を並べて示します。最高スコアは Claude Opus 5.5 の 167.3 です。Claude Sonnet 5.5 は 2.2 ポイント差で、料金は 50% です。
ここで比べたモデルの中で Epoch Capabilities Index のスコアが最も高いモデルです。
1位より 2.2 ポイント低いだけで料金は 50%、コスパのラインに乗っています。
1位から15ポイント以内のモデルで最も安く、1位の料金の 5% です。
新しいモデルのため、Epoch AI がまだ性能スコアを公開していません。公開されると自動でグラフに加わります。現在の料金:
- GPT-6.1 Sol$2 / $10 · $4.00AA 51.8 · Astra 52.7
- GPT-6 Sol$2 / $10 · $4.00
- GPT-6 Luna$0.1 / $0.5 · $0.20
- Gemini 4 Argon$4 / $20 · $7.60
- Grok 4.7$2 / $6 · $3.00
- Mistral Large 3$0.5 / $1.5 · $0.79
尺度が違うためグラフには載せられませんが、独立した測定結果が1つ出ています。Artificial Analysis Intelligence Index(v4.3.2、最大推論、2026-09-30時点)で GPT-6.1 Sol は 51.8、GPT-6 Astra の 52.7 にほぼ並びます。料金は Astra の5分の1です。
コスパの良いモデル
コスパのライン上のモデルは、「もっと安くてもっと賢いモデル」が存在しないモデルです。安い順に:GPT-5 nano, DeepSeek V4 Flash, Gemini 3.8 Flash, Claude Sonnet 5.5, Claude Opus 5.5。ラインより下のモデルは、同じかそれ以上のスコアを持つライン上のモデルより高くつきます。
全スコアと料金
| モデル | ECI (90%範囲) | 入力 / 出力 100万あたり | 混合料金 100万あたり |
|---|---|---|---|
| Claude Opus 5.5 ★ コスパ | 167.3 164–172 | $4 / $20 | $10.40 |
| GPT-6 Astra | 166.5 163–171 | $10 / $50 | $20.00 |
| Claude Sonnet 5.5 ★ コスパ | 165.2 162–169 | $2 / $10 | $5.20 |
| Claude Fable 5.1 | 164.8 162–169 | $10 / $50 | $26.00 |
| GPT-5.5 | 159.2 157–162 | $5 / $30 | $11.25 |
| Kimi K3 | 157.6 155–160 | $3 / $15 | $6.00 |
| Gemini 3.8 Flash ★ コスパ | 156.9 155–160 | $0.75 / $3.75 | $1.42 |
| DeepSeek V4 Pro | 155.4 154–158 | $1.32 / $3.96 | $1.98 |
| Qwen 3.8 Max | 155.2 153–157 | $2 / $6 | $3.00 |
| Gemini 3.1 Pro | 154.8 153–157 | $2 / $12 | $4.27 |
| DeepSeek V4 Flash ★ コスパ | 154.5 152–157 | $0.3 / $1.2 | $0.52 |
| Grok 4.20 | 152.0 149–154 | $1.25 / $2.5 | $1.56 |
| Kimi K2.6 | 151.1 149–153 | $0.95 / $4 | $1.71 |
| GPT-5 mini | 145.5 144–147 | $0.25 / $2 | $0.69 |
| Gemini 3.5 Flash-Lite | 145.1 142–147 | $0.3 / $2.5 | $0.81 |
| Gemini 3.1 Flash-Lite | 144.4 142–146 | $0.25 / $1.5 | $0.53 |
| Claude Haiku 4.5 | 142.4 140–144 | $1 / $5 | $2.10 |
| Mistral Medium 3.5 | 141.4 138–144 | $1.5 / $7.5 | $3.15 |
| GPT-5 nano ★ コスパ | 139.4 135–142 | $0.05 / $0.4 | $0.14 |
| GPT-4.1 | 136.8 134–138 | $2 / $8 | $3.50 |
| GPT-4.1 mini | 135.0 131–137 | $0.4 / $1.6 | $0.70 |
| GPT-4o | 128.8 124–131 | $2.5 / $10 | $4.38 |
| GPT-4o mini | 126.6 120–129 | $0.15 / $0.6 | $0.26 |
混合料金 =(入力 × 3 + 出力)÷ 4、100万トークンあたり。一般的なチャットの比率で、モデルごとのトークナイザーの差(同じ英文に使うトークン数)を反映しています。定価で、キャッシュやバッチ割引は含みません。
スコアの意味
ECI は数学、コーディング、科学、推論など数十のベンチマークを1つの尺度にまとめたスコアです。そのため、異なるベンチマークで測られたモデルも比べられます。数ポイントの差は誤差の範囲内のことが多く、表の90%範囲が推定の確かさを示します。総合性能であって自分の作業での性能ではないので、特定の用途にはライン上のモデルをいくつか自分のプロンプトで試してください。
自分のプロンプトがモデルごとにいくらかかるかはトークンカウンターに貼り付けて確認できます。2つのモデルを並べて比べるなら比較ページ(英語)へ。
モデルごとの詳しい解説:2026年10月 AIコスパランキング。
性能スコア:Epoch AI の Epoch Capabilities Index(CC BY 4.0)を使用。 料金:TokenSave、毎日更新。