전체 비교 (영어) · 점수 2026-10-04 기준 · 가격 2026-10-01 기준
AI 모델 성능 vs 가격 순위
비싼 모델이 항상 더 똑똑한 건 아닙니다. 이 그래프는 모델마다 종합 성능(Epoch Capabilities Index, ECI)과 API 가격을 함께 보여 줍니다. 가장 높은 점수는 Claude Opus 5.5의 167.3점입니다. Claude Sonnet 5.5는 2.2점 차이로 따라오는데 가격은 50%입니다.
여기서 비교한 모델 중 Epoch Capabilities Index 점수가 가장 높습니다.
1위보다 2.2점 낮지만 가격은 50%이고, 가성비 라인 위에 있습니다.
1위와 15점 이내 모델 중 가장 쌉니다. 1위 모델 가격의 5%입니다.
새로 나온 모델이라 Epoch AI가 아직 성능 점수를 내지 않았습니다. 점수가 나오면 그래프에 자동으로 들어갑니다. 현재 가격:
- GPT-6.1 Sol$2 / $10 · $4.00AA 51.8 · Astra 52.7
- GPT-6 Sol$2 / $10 · $4.00
- GPT-6 Luna$0.1 / $0.5 · $0.20
- Gemini 4 Argon$4 / $20 · $7.60
- Grok 4.7$2 / $6 · $3.00
- Mistral Large 3$0.5 / $1.5 · $0.79
점수 체계가 달라 그래프에는 넣을 수 없지만 독립 측정 결과가 하나 나와 있습니다. Artificial Analysis Intelligence Index(v4.3.2, 최대 추론, 2026-09-30 기준)에서 GPT-6.1 Sol은 51.8점으로 GPT-6 Astra(52.7점)에 거의 근접했습니다. 가격은 Astra의 1/5입니다.
가성비 좋은 모델
가성비 라인 위의 모델은 "더 싸면서 더 똑똑한 모델"이 없는 모델입니다. 싼 순서대로: GPT-5 nano, DeepSeek V4 Flash, Gemini 3.8 Flash, Claude Sonnet 5.5, Claude Opus 5.5. 라인 아래에 있는 모델은 같은 점수 이상의 라인 위 모델보다 비쌉니다.
전체 점수와 가격
| 모델 | ECI (90% 범위) | 입력 / 출력 100만 토큰당 | 혼합 가격 100만 토큰당 |
|---|---|---|---|
| Claude Opus 5.5 ★ 가성비 | 167.3 164–172 | $4 / $20 | $10.40 |
| GPT-6 Astra | 166.5 163–171 | $10 / $50 | $20.00 |
| Claude Sonnet 5.5 ★ 가성비 | 165.2 162–169 | $2 / $10 | $5.20 |
| Claude Fable 5.1 | 164.8 162–169 | $10 / $50 | $26.00 |
| GPT-5.5 | 159.2 157–162 | $5 / $30 | $11.25 |
| Kimi K3 | 157.6 155–160 | $3 / $15 | $6.00 |
| Gemini 3.8 Flash ★ 가성비 | 156.9 155–160 | $0.75 / $3.75 | $1.42 |
| DeepSeek V4 Pro | 155.4 154–158 | $1.32 / $3.96 | $1.98 |
| Qwen 3.8 Max | 155.2 153–157 | $2 / $6 | $3.00 |
| Gemini 3.1 Pro | 154.8 153–157 | $2 / $12 | $4.27 |
| DeepSeek V4 Flash ★ 가성비 | 154.5 152–157 | $0.3 / $1.2 | $0.52 |
| Grok 4.20 | 152.0 149–154 | $1.25 / $2.5 | $1.56 |
| Kimi K2.6 | 151.1 149–153 | $0.95 / $4 | $1.71 |
| GPT-5 mini | 145.5 144–147 | $0.25 / $2 | $0.69 |
| Gemini 3.5 Flash-Lite | 145.1 142–147 | $0.3 / $2.5 | $0.81 |
| Gemini 3.1 Flash-Lite | 144.4 142–146 | $0.25 / $1.5 | $0.53 |
| Claude Haiku 4.5 | 142.4 140–144 | $1 / $5 | $2.10 |
| Mistral Medium 3.5 | 141.4 138–144 | $1.5 / $7.5 | $3.15 |
| GPT-5 nano ★ 가성비 | 139.4 135–142 | $0.05 / $0.4 | $0.14 |
| GPT-4.1 | 136.8 134–138 | $2 / $8 | $3.50 |
| GPT-4.1 mini | 135.0 131–137 | $0.4 / $1.6 | $0.70 |
| GPT-4o | 128.8 124–131 | $2.5 / $10 | $4.38 |
| GPT-4o mini | 126.6 120–129 | $0.15 / $0.6 | $0.26 |
혼합 가격 = (입력 × 3 + 출력) ÷ 4, 100만 토큰당. 일반적인 대화 비율이며, 모델별 토크나이저 차이(같은 영어 문장에 쓰는 토큰 수)를 반영했습니다. 정가 기준이며 캐싱·배치 할인은 넣지 않았습니다.
점수의 의미
ECI는 수학, 코딩, 과학, 추론 등 수십 개의 벤치마크를 하나의 척도로 합친 점수입니다. 그래서 서로 다른 벤치마크로 측정된 모델도 비교할 수 있습니다. 몇 점 차이는 오차 범위 안인 경우가 많고, 표의 90% 범위가 추정의 확실성을 보여 줍니다. 종합 성능이지 내 작업 성능은 아니니, 특정 작업에는 가성비 라인 위 모델 몇 개를 내 프롬프트로 직접 시험해 보세요.
내 프롬프트가 모델마다 얼마인지는 토큰 계산기에 붙여 넣어 보세요. 두 모델을 나란히 비교하려면 비교 페이지(영어)를 보세요.
모델별로 자세히 풀어 쓴 글: 2026년 10월 AI 가성비 순위.
성능 점수: Epoch AI의 Epoch Capabilities Index, CC BY 4.0 라이선스로 사용. 가격: TokenSave, 매일 갱신.