벤치마크
모델의 점수와 평가 조건을 함께 확인하세요.
22 개 평가 · 확인 2026-09-05Epoch Capabilities Index
50개 이상의 벤치마크 결과를 하나의 척도로 연결해 모델의 전반적인 역량을 비교합니다.
자료 기준 확인일 General ECI
10 개 결과
- 1GPT-6 Astra169.23
- 2Claude Fable 5162.90
- 3Claude Fable 5.1162.88
- 4Claude Opus 5162.33
- 5GPT-5.6 Sol162.03
- 6GPT-5.5 Pro162.03
- 7GPT-5.5159.23
- 8GPT-5.6 Terra159.18
- 9GPT-5.4 Pro158.89
- 10Claude Opus 4.8158.24
모델별 고정색 · 상위 10개 결과 표시 · 전체 값과 조건은 상세 표에서 확인하세요.
정확한 값과 실행 조건
| # | 모델·설정 | 점수 | 신뢰구간 / 추가 정보 |
|---|---|---|---|
| 1 | GPT-6 AstraOpenAI | 169.23 | 90% CI 164.85–174.02 |
| 2 | Claude Fable 5Anthropic | 162.90 | 90% CI 160.17–166.77 |
| 3 | Claude Fable 5.1Anthropic | 162.88 | 90% CI 160.10–166.34 |
| 4 | Claude Opus 5Anthropic | 162.33 | 90% CI 159.75–165.78 |
| 5 | GPT-5.6 SolOpenAI | 162.03 | 90% CI 159.66–165.00 |
| 6 | GPT-5.5 ProOpenAI | 162.03 | 90% CI 159.21–165.06 |
| 7 | GPT-5.5OpenAI | 159.23 | 90% CI 156.94–162.02 |
| 8 | GPT-5.6 TerraOpenAI | 159.18 | 90% CI 156.60–161.61 |
| 9 | GPT-5.4 ProOpenAI | 158.89 | 90% CI 156.54–161.67 |
| 10 | Claude Opus 4.8Anthropic | 158.24 | 90% CI 156.14–160.53 |
무엇을 평가하나요
특정 시험의 만점 도달에 덜 영향받으며 여러 세대 모델의 역량 차이를 살펴볼 때 유용합니다.
해석할 때 주의할 점
정답률이나 IQ가 아닙니다. 절대값보다 모델 간 차이를 읽어야 합니다. 공식 모델 그룹 단위 결과이며 90% 신뢰구간이 겹치면 순위를 단정하기 어렵습니다. 평가 구성에 따라 과거 값도 재산정될 수 있습니다.