比較一覧(英語) · スコア 2026-10-04 時点 · 料金 2026-10-01 時点

AIモデルの性能と価格ランキング

高いモデルがいつも賢いとは限りません。このグラフは、各モデルの総合性能(Epoch Capabilities Index、ECI)とAPI料金を並べて示します。最高スコアは Claude Opus 5.5 の 167.3 です。Claude Sonnet 5.5 は 2.2 ポイント差で、料金は 50% です。

コスパ
Claude Sonnet 5.5
ECI 165.2 · $5.20 100万トークンあたり

1位より 2.2 ポイント低いだけで料金は 50%、コスパのラインに乗っています。

AIモデルの性能(Epoch Capabilities Index)と100万トークンあたりAPI料金の散布図、コスパのラインを表示
性能(ECI)と100万トークンあたりの混合API料金、23モデル。緑の点はその価格帯で最もコスパの良いモデルです。
⏳ スコア待ち

新しいモデルのため、Epoch AI がまだ性能スコアを公開していません。公開されると自動でグラフに加わります。現在の料金:

  • GPT-6.1 Sol$2 / $10 · $4.00AA 51.8 · Astra 52.7
  • GPT-6 Sol$2 / $10 · $4.00
  • GPT-6 Luna$0.1 / $0.5 · $0.20
  • Gemini 4 Argon$4 / $20 · $7.60
  • Grok 4.7$2 / $6 · $3.00
  • Mistral Large 3$0.5 / $1.5 · $0.79

尺度が違うためグラフには載せられませんが、独立した測定結果が1つ出ています。Artificial Analysis Intelligence Index(v4.3.2、最大推論、2026-09-30時点)で GPT-6.1 Sol は 51.8、GPT-6 Astra の 52.7 にほぼ並びます。料金は Astra の5分の1です。

コスパの良いモデル

コスパのライン上のモデルは、「もっと安くてもっと賢いモデル」が存在しないモデルです。安い順に:GPT-5 nano, DeepSeek V4 Flash, Gemini 3.8 Flash, Claude Sonnet 5.5, Claude Opus 5.5。ラインより下のモデルは、同じかそれ以上のスコアを持つライン上のモデルより高くつきます。

全スコアと料金

モデルECI
(90%範囲)
入力 / 出力
100万あたり
混合料金
100万あたり
Claude Opus 5.5 ★ コスパ167.3
164–172
$4 / $20$10.40
GPT-6 Astra166.5
163–171
$10 / $50$20.00
Claude Sonnet 5.5 ★ コスパ165.2
162–169
$2 / $10$5.20
Claude Fable 5.1164.8
162–169
$10 / $50$26.00
GPT-5.5159.2
157–162
$5 / $30$11.25
Kimi K3157.6
155–160
$3 / $15$6.00
Gemini 3.8 Flash ★ コスパ156.9
155–160
$0.75 / $3.75$1.42
DeepSeek V4 Pro155.4
154–158
$1.32 / $3.96$1.98
Qwen 3.8 Max155.2
153–157
$2 / $6$3.00
Gemini 3.1 Pro154.8
153–157
$2 / $12$4.27
DeepSeek V4 Flash ★ コスパ154.5
152–157
$0.3 / $1.2$0.52
Grok 4.20152.0
149–154
$1.25 / $2.5$1.56
Kimi K2.6151.1
149–153
$0.95 / $4$1.71
GPT-5 mini145.5
144–147
$0.25 / $2$0.69
Gemini 3.5 Flash-Lite145.1
142–147
$0.3 / $2.5$0.81
Gemini 3.1 Flash-Lite144.4
142–146
$0.25 / $1.5$0.53
Claude Haiku 4.5142.4
140–144
$1 / $5$2.10
Mistral Medium 3.5141.4
138–144
$1.5 / $7.5$3.15
GPT-5 nano ★ コスパ139.4
135–142
$0.05 / $0.4$0.14
GPT-4.1136.8
134–138
$2 / $8$3.50
GPT-4.1 mini135.0
131–137
$0.4 / $1.6$0.70
GPT-4o128.8
124–131
$2.5 / $10$4.38
GPT-4o mini126.6
120–129
$0.15 / $0.6$0.26

混合料金 =(入力 × 3 + 出力)÷ 4、100万トークンあたり。一般的なチャットの比率で、モデルごとのトークナイザーの差(同じ英文に使うトークン数)を反映しています。定価で、キャッシュやバッチ割引は含みません。

スコアの意味

ECI は数学、コーディング、科学、推論など数十のベンチマークを1つの尺度にまとめたスコアです。そのため、異なるベンチマークで測られたモデルも比べられます。数ポイントの差は誤差の範囲内のことが多く、表の90%範囲が推定の確かさを示します。総合性能であって自分の作業での性能ではないので、特定の用途にはライン上のモデルをいくつか自分のプロンプトで試してください。

自分のプロンプトがモデルごとにいくらかかるかはトークンカウンターに貼り付けて確認できます。2つのモデルを並べて比べるなら比較ページ(英語)へ。

モデルごとの詳しい解説:2026年10月 AIコスパランキング。

性能スコア:Epoch AI の Epoch Capabilities Index(CC BY 4.0)を使用。 料金:TokenSave、毎日更新。