Epoch AI · 종합 능력 지수 (ECI)
공개된 벤치마크 자료(LMArena 사용자 투표 순위, Epoch AI 시험 점수, OpenRouter 사용량 순위)를 정기적으로 받아 보여 줍니다. 각 순위표의 공개일과 가져온 날을 함께 표시합니다. 이 사이트가 직접 매긴 점수가 아닙니다.
이 순위표 읽는 법
무엇을 재나: Epoch AI가 여러 벤치마크 점수를 공통 척도로 합친 종합 능력 지수입니다. 벤치마크별 난이도와 점수 변화 특성을 통계적으로 추정해, 서로 다른 시험을 본 모델도 비교할 수 있게 만든 값입니다.
점수 읽는 법: 정답률이 아닌 상대적인 능력 추정값입니다. 점수 차이를 실제 사용에서 느끼는 차이로 바로 환산할 수는 없습니다. 여러 시험에서의 전반적인 위치를 볼 때 참고하세요.
주의할 점: 특정 용도의 능력은 해당 벤치마크도 따로 확인하세요. 평가 결과나 포함 벤치마크가 추가되면 추정값과 불확실성이 바뀔 수 있습니다.
이번 순위에서 읽을 점
- 최고 점수는 Claude Opus 5.5의 167.4입니다.
- 1위와 5위의 차이는 4.5입니다.
- 상위 10개 중 Anthropic 모델이 5개로 가장 많습니다.
- 이 시험 결과가 공개된 모델은 60개입니다.
종합 능력 지수 (ECI) Epoch AI
ECI는 Epoch AI가 여러 시험 결과를 하나로 묶은 종합 지수입니다. 점수가 높을수록 전반적인 능력이 높다는 뜻입니다. · 가져온 날 2026-10-04
표로 보기 (상위 40개)
| 순위 | 모델 | 만든 곳 | 출시일 | 점수 |
|---|---|---|---|---|
| 1 | #1Claude Opus 5.5 | Anthropic | 2026-09-22 | 167.4 |
| 2 | #2OGPT-6 Astra | OpenAI | 2026-09-03 | 166.5 |
| 3 | #3Claude Sonnet 5.5 | Anthropic | 2026-09-28 | 165.2 |
| 4 | #4Claude Fable 5.1 | Anthropic | 2026-09-01 | 164.8 |
| 5 | #5Claude Opus 5 | Anthropic | 2026-07-24 | 162.9 |
| 6 | #6OGPT-5.5 Pro | OpenAI | 2026-04-23 | 162.4 |
| 7 | #7Claude Fable 5 | Anthropic | 2026-06-09 | 162.2 |
| 8 | #8OGPT-5.6 Sol | OpenAI | 2026-07-09 | 161.8 |
| 9 | #9OGPT-5.6 Terra | OpenAI | 2026-07-09 | 159.8 |
| 10 | #10OGPT-5.5 | OpenAI | 2026-04-23 | 159.2 |
| 11 | #11OGPT-5.4 Pro | OpenAI | 2026-03-05 | 159.1 |
| 12 | #12Claude Opus 4.8 | Anthropic | 2026-05-28 | 158.3 |
| 13 | #13Kimi K3 | Moonshot AI | 2026-07-16 | 157.6 |
| 14 | #14Gemini 3.7 Flash | 2026-08-13 | 157.4 | |
| 15 | #15Gemini 3.8 Flash | 2026-09-02 | 156.9 | |
| 16 | #16OGPT-5.4 | OpenAI | 2026-03-05 | 156.9 |
| 17 | #17Muse Spark 1.3 | Meta | 2026-09-02 | 156.9 |
| 18 | #18OGPT-5.3 Codex | OpenAI | 2026-02-05 | 156.8 |
| 19 | #19xGrok 4.6 | xAI | 2026-08-12 | 156.6 |
| 20 | #20Qwen 3.8 Max | Alibaba | 2026-08-02 | 156.6 |
| 21 | #21OGPT-5.6 Luna | OpenAI | 2026-07-09 | 156.5 |
| 22 | #22Claude Opus 4.7 | Anthropic | 2026-04-16 | 156.4 |
| 23 | #23Claude Sonnet 5 | Anthropic | 2026-06-30 | 156.3 |
| 24 | #24ZGLM-5.3 | Z.ai | 2026-08-14 | 155.8 |
| 25 | #25OGPT-5.2 Pro | OpenAI | 2025-12-11 | 155.4 |
| 26 | #26DeepSeek V4 Pro 0813 | DeepSeek | 2026-08-13 | 155.4 |
| 27 | #27Claude Opus 4.6 | Anthropic | 2026-02-05 | 155.3 |
| 28 | #28Qwen3.8 Max (0902) | Alibaba | 2026-09-01 | 155.2 |
| 29 | #29DeepSeek V4.1 Flash | DeepSeek | 2026-09-09 | 155 |
| 30 | #30Muse Spark 1.2 | Meta | 2026-08-05 | 155 |
| 31 | #31Gemini 3.1 Pro | 2026-02-19 | 154.8 | |
| 32 | #32DeepSeek V4 Flash 0731 | DeepSeek | 2026-07-31 | 154.5 |
| 33 | #33Gemini 3.5 Flash | 2026-05-19 | 154.5 | |
| 34 | #34Gemini 3.6 Flash | 2026-07-21 | 154.3 | |
| 35 | #35Muse Spark 1.1 | Meta | 2026-07-09 | 154.3 |
| 36 | #36xGrok 4.5 | xAI | 2026-07-08 | 154 |
| 37 | #37Qwen3.7-Max | Alibaba | 2026-05-19 | 153.7 |
| 38 | #38OGPT-5.2 | OpenAI | 2025-12-11 | 153.5 |
| 39 | #39Gemini 3 Pro | 2025-11-18 | 153 | |
| 40 | #40Claude Sonnet 4.6 | Anthropic | 2026-02-17 | 152.3 |
데이터: LMArena leaderboard dataset (CC BY 4.0). 변경: 각 순위표의 상위 50개만 표시, 점수는 반올림. https://huggingface.co/datasets/lmarena-ai/leaderboard-dataset회사 로고는 각 회사의 상표이며 구분을 돕기 위해서만 씁니다(아이콘: Simple Icons).데이터: Epoch AI — Capabilities & benchmarking (CC BY 4.0). https://epoch.ai/benchmarksSource: OpenRouter (openrouter.ai/rankings), as of 2026-10-04. Licensed under CC BY 4.0. https://openrouter.ai/rankings