Valumigo

Epoch AI · 종합 능력 지수 (ECI)

공개된 벤치마크 자료(LMArena 사용자 투표 순위, Epoch AI 시험 점수, OpenRouter 사용량 순위)를 정기적으로 받아 보여 줍니다. 각 순위표의 공개일과 가져온 날을 함께 표시합니다. 이 사이트가 직접 매긴 점수가 아닙니다.

LMArena 점수는 사람들이 두 모델의 답을 나란히 보고 더 나은 쪽에 투표한 결과(Elo 방식)입니다. 점수 차이가 신뢰 구간 안이면 사실상 비슷한 수준으로 보세요.

이 순위표 읽는 법

무엇을 재나: Epoch AI가 여러 벤치마크 점수를 공통 척도로 합친 종합 능력 지수입니다. 벤치마크별 난이도와 점수 변화 특성을 통계적으로 추정해, 서로 다른 시험을 본 모델도 비교할 수 있게 만든 값입니다.

점수 읽는 법: 정답률이 아닌 상대적인 능력 추정값입니다. 점수 차이를 실제 사용에서 느끼는 차이로 바로 환산할 수는 없습니다. 여러 시험에서의 전반적인 위치를 볼 때 참고하세요.

주의할 점: 특정 용도의 능력은 해당 벤치마크도 따로 확인하세요. 평가 결과나 포함 벤치마크가 추가되면 추정값과 불확실성이 바뀔 수 있습니다.

이번 순위에서 읽을 점

  • 최고 점수는 Claude Opus 5.5의 167.4입니다.
  • 1위와 5위의 차이는 4.5입니다.
  • 상위 10개 중 Anthropic 모델이 5개로 가장 많습니다.
  • 이 시험 결과가 공개된 모델은 60개입니다.

종합 능력 지수 (ECI) Epoch AI

ECI는 Epoch AI가 여러 시험 결과를 하나로 묶은 종합 지수입니다. 점수가 높을수록 전반적인 능력이 높다는 뜻입니다. · 가져온 날 2026-10-04

156159162165168
AnthropicClaude Opus 5.5
167.4
OGPT-6 Astra
166.5
AnthropicClaude Sonnet 5.5
165.2
AnthropicClaude Fable 5.1
164.8
AnthropicClaude Opus 5
162.9
OGPT-5.5 Pro
162.4
AnthropicClaude Fable 5
162.2
OGPT-5.6 Sol
161.8
OGPT-5.6 Terra
159.8
OGPT-5.5
159.2
OGPT-5.4 Pro
159.1
AnthropicClaude Opus 4.8
158.3
Moonshot AIKimi K3
157.6
GoogleGemini 3.7 Flash
157.4
GoogleGemini 3.8 Flash
156.9
OGPT-5.4
156.9
MetaMuse Spark 1.3
156.9
OGPT-5.3 Codex
156.8
xGrok 4.6
156.6
AlibabaQwen 3.8 Max
156.6
표로 보기 (상위 40개)
순위모델만든 곳출시일점수
1#1AnthropicClaude Opus 5.5Anthropic2026-09-22167.4
2#2OGPT-6 AstraOpenAI2026-09-03166.5
3#3AnthropicClaude Sonnet 5.5Anthropic2026-09-28165.2
4#4AnthropicClaude Fable 5.1Anthropic2026-09-01164.8
5#5AnthropicClaude Opus 5Anthropic2026-07-24162.9
6#6OGPT-5.5 ProOpenAI2026-04-23162.4
7#7AnthropicClaude Fable 5Anthropic2026-06-09162.2
8#8OGPT-5.6 SolOpenAI2026-07-09161.8
9#9OGPT-5.6 TerraOpenAI2026-07-09159.8
10#10OGPT-5.5OpenAI2026-04-23159.2
11#11OGPT-5.4 ProOpenAI2026-03-05159.1
12#12AnthropicClaude Opus 4.8Anthropic2026-05-28158.3
13#13Moonshot AIKimi K3Moonshot AI2026-07-16157.6
14#14GoogleGemini 3.7 FlashGoogle2026-08-13157.4
15#15GoogleGemini 3.8 FlashGoogle2026-09-02156.9
16#16OGPT-5.4OpenAI2026-03-05156.9
17#17MetaMuse Spark 1.3Meta2026-09-02156.9
18#18OGPT-5.3 CodexOpenAI2026-02-05156.8
19#19xGrok 4.6xAI2026-08-12156.6
20#20AlibabaQwen 3.8 MaxAlibaba2026-08-02156.6
21#21OGPT-5.6 LunaOpenAI2026-07-09156.5
22#22AnthropicClaude Opus 4.7Anthropic2026-04-16156.4
23#23AnthropicClaude Sonnet 5Anthropic2026-06-30156.3
24#24ZGLM-5.3Z.ai2026-08-14155.8
25#25OGPT-5.2 ProOpenAI2025-12-11155.4
26#26DeepSeekDeepSeek V4 Pro 0813DeepSeek2026-08-13155.4
27#27AnthropicClaude Opus 4.6Anthropic2026-02-05155.3
28#28AlibabaQwen3.8 Max (0902)Alibaba2026-09-01155.2
29#29DeepSeekDeepSeek V4.1 FlashDeepSeek2026-09-09155
30#30MetaMuse Spark 1.2Meta2026-08-05155
31#31GoogleGemini 3.1 ProGoogle2026-02-19154.8
32#32DeepSeekDeepSeek V4 Flash 0731DeepSeek2026-07-31154.5
33#33GoogleGemini 3.5 FlashGoogle2026-05-19154.5
34#34GoogleGemini 3.6 FlashGoogle2026-07-21154.3
35#35MetaMuse Spark 1.1Meta2026-07-09154.3
36#36xGrok 4.5xAI2026-07-08154
37#37AlibabaQwen3.7-MaxAlibaba2026-05-19153.7
38#38OGPT-5.2OpenAI2025-12-11153.5
39#39GoogleGemini 3 ProGoogle2025-11-18153
40#40AnthropicClaude Sonnet 4.6Anthropic2026-02-17152.3

데이터: LMArena leaderboard dataset (CC BY 4.0). 변경: 각 순위표의 상위 50개만 표시, 점수는 반올림. https://huggingface.co/datasets/lmarena-ai/leaderboard-dataset회사 로고는 각 회사의 상표이며 구분을 돕기 위해서만 씁니다(아이콘: Simple Icons).데이터: Epoch AI — Capabilities & benchmarking (CC BY 4.0). https://epoch.ai/benchmarksSource: OpenRouter (openrouter.ai/rankings), as of 2026-10-04. Licensed under CC BY 4.0. https://openrouter.ai/rankings