벤치마크

모델의 점수와 평가 조건을 함께 확인하세요.

22 개 평가 · 확인 2026-09-05
Epoch AI종합 지수확인된 스냅샷

Epoch Capabilities Index

50개 이상의 벤치마크 결과를 하나의 척도로 연결해 모델의 전반적인 역량을 비교합니다.

자료 기준 확인일 General ECI
10 개 결과
ECI · 높을수록 좋음표시 구간 0–170 · 지수의 상한이 아님
  1. 1GPT-6 Astra169.23
  2. 2Claude Fable 5162.90
  3. 3Claude Fable 5.1162.88
  4. 4Claude Opus 5162.33
  5. 5GPT-5.6 Sol162.03
  6. 6GPT-5.5 Pro162.03
  7. 7GPT-5.5159.23
  8. 8GPT-5.6 Terra159.18
  9. 9GPT-5.4 Pro158.89
  10. 10Claude Opus 4.8158.24

모델별 고정색 · 상위 10개 결과 표시 · 전체 값과 조건은 상세 표에서 확인하세요.

무엇을 평가하나요

특정 시험의 만점 도달에 덜 영향받으며 여러 세대 모델의 역량 차이를 살펴볼 때 유용합니다.

해석할 때 주의할 점

정답률이나 IQ가 아닙니다. 절대값보다 모델 간 차이를 읽어야 합니다. 공식 모델 그룹 단위 결과이며 90% 신뢰구간이 겹치면 순위를 단정하기 어렵습니다. 평가 구성에 따라 과거 값도 재산정될 수 있습니다.