전체 비교 (영어) · 점수 2026-10-04 기준 · 가격 2026-10-01 기준

AI 모델 성능 vs 가격 순위

비싼 모델이 항상 더 똑똑한 건 아닙니다. 이 그래프는 모델마다 종합 성능(Epoch Capabilities Index, ECI)과 API 가격을 함께 보여 줍니다. 가장 높은 점수는 Claude Opus 5.5의 167.3점입니다. Claude Sonnet 5.5는 2.2점 차이로 따라오는데 가격은 50%입니다.

가성비
Claude Sonnet 5.5
ECI 165.2 · $5.20 100만 토큰당

1위보다 2.2점 낮지만 가격은 50%이고, 가성비 라인 위에 있습니다.

AI 모델 성능(Epoch Capabilities Index)과 100만 토큰당 API 가격 점그래프, 가성비 라인 표시
성능(ECI) vs 100만 토큰당 혼합 API 가격, 모델 23개. 초록 점은 같은 가격대에서 가성비가 가장 좋은 모델입니다.
⏳ 점수 대기 중

새로 나온 모델이라 Epoch AI가 아직 성능 점수를 내지 않았습니다. 점수가 나오면 그래프에 자동으로 들어갑니다. 현재 가격:

  • GPT-6.1 Sol$2 / $10 · $4.00AA 51.8 · Astra 52.7
  • GPT-6 Sol$2 / $10 · $4.00
  • GPT-6 Luna$0.1 / $0.5 · $0.20
  • Gemini 4 Argon$4 / $20 · $7.60
  • Grok 4.7$2 / $6 · $3.00
  • Mistral Large 3$0.5 / $1.5 · $0.79

점수 체계가 달라 그래프에는 넣을 수 없지만 독립 측정 결과가 하나 나와 있습니다. Artificial Analysis Intelligence Index(v4.3.2, 최대 추론, 2026-09-30 기준)에서 GPT-6.1 Sol은 51.8점으로 GPT-6 Astra(52.7점)에 거의 근접했습니다. 가격은 Astra의 1/5입니다.

가성비 좋은 모델

가성비 라인 위의 모델은 "더 싸면서 더 똑똑한 모델"이 없는 모델입니다. 싼 순서대로: GPT-5 nano, DeepSeek V4 Flash, Gemini 3.8 Flash, Claude Sonnet 5.5, Claude Opus 5.5. 라인 아래에 있는 모델은 같은 점수 이상의 라인 위 모델보다 비쌉니다.

전체 점수와 가격

모델ECI
(90% 범위)
입력 / 출력
100만 토큰당
혼합 가격
100만 토큰당
Claude Opus 5.5 ★ 가성비167.3
164–172
$4 / $20$10.40
GPT-6 Astra166.5
163–171
$10 / $50$20.00
Claude Sonnet 5.5 ★ 가성비165.2
162–169
$2 / $10$5.20
Claude Fable 5.1164.8
162–169
$10 / $50$26.00
GPT-5.5159.2
157–162
$5 / $30$11.25
Kimi K3157.6
155–160
$3 / $15$6.00
Gemini 3.8 Flash ★ 가성비156.9
155–160
$0.75 / $3.75$1.42
DeepSeek V4 Pro155.4
154–158
$1.32 / $3.96$1.98
Qwen 3.8 Max155.2
153–157
$2 / $6$3.00
Gemini 3.1 Pro154.8
153–157
$2 / $12$4.27
DeepSeek V4 Flash ★ 가성비154.5
152–157
$0.3 / $1.2$0.52
Grok 4.20152.0
149–154
$1.25 / $2.5$1.56
Kimi K2.6151.1
149–153
$0.95 / $4$1.71
GPT-5 mini145.5
144–147
$0.25 / $2$0.69
Gemini 3.5 Flash-Lite145.1
142–147
$0.3 / $2.5$0.81
Gemini 3.1 Flash-Lite144.4
142–146
$0.25 / $1.5$0.53
Claude Haiku 4.5142.4
140–144
$1 / $5$2.10
Mistral Medium 3.5141.4
138–144
$1.5 / $7.5$3.15
GPT-5 nano ★ 가성비139.4
135–142
$0.05 / $0.4$0.14
GPT-4.1136.8
134–138
$2 / $8$3.50
GPT-4.1 mini135.0
131–137
$0.4 / $1.6$0.70
GPT-4o128.8
124–131
$2.5 / $10$4.38
GPT-4o mini126.6
120–129
$0.15 / $0.6$0.26

혼합 가격 = (입력 × 3 + 출력) ÷ 4, 100만 토큰당. 일반적인 대화 비율이며, 모델별 토크나이저 차이(같은 영어 문장에 쓰는 토큰 수)를 반영했습니다. 정가 기준이며 캐싱·배치 할인은 넣지 않았습니다.

점수의 의미

ECI는 수학, 코딩, 과학, 추론 등 수십 개의 벤치마크를 하나의 척도로 합친 점수입니다. 그래서 서로 다른 벤치마크로 측정된 모델도 비교할 수 있습니다. 몇 점 차이는 오차 범위 안인 경우가 많고, 표의 90% 범위가 추정의 확실성을 보여 줍니다. 종합 성능이지 내 작업 성능은 아니니, 특정 작업에는 가성비 라인 위 모델 몇 개를 내 프롬프트로 직접 시험해 보세요.

내 프롬프트가 모델마다 얼마인지는 토큰 계산기에 붙여 넣어 보세요. 두 모델을 나란히 비교하려면 비교 페이지(영어)를 보세요.

모델별로 자세히 풀어 쓴 글: 2026년 10월 AI 가성비 순위.

성능 점수: Epoch AI의 Epoch Capabilities Index, CC BY 4.0 라이선스로 사용. 가격: TokenSave, 매일 갱신.