Artificial Analysis · 지능 지수
공개된 벤치마크 자료(LMArena 사용자 투표 순위, Epoch AI 시험 점수, OpenRouter 사용량 순위)를 정기적으로 받아 보여 줍니다. 각 순위표의 공개일과 가져온 날을 함께 표시합니다. 이 사이트가 직접 매긴 점수가 아닙니다.
이 순위표 읽는 법
무엇을 재나: Artificial Analysis가 여러 평가를 직접 실행해 하나로 묶은 종합 지능 지수입니다. OpenRouter 공개 데이터 API를 통해 받았습니다.
점수 읽는 법: 높을수록 여러 시험에서 고르게 좋은 결과를 냈다는 뜻입니다. 같은 모델도 추론 설정(Max, High 등)에 따라 따로 표시됩니다.
주의할 점: 지수에 포함된 시험 구성은 Artificial Analysis가 버전마다 바꿀 수 있어, 시기가 다른 점수끼리는 비교하지 마세요.
이번 순위에서 읽을 점
- 최고 점수는 Claude Opus 5.5 (Max, Default Fallback)의 57.6입니다.
- 1위와 5위의 차이는 4.9입니다.
- 상위 10개 중 Anthropic 모델이 5개로 가장 많습니다.
지능 지수 Artificial Analysis
공개일 2026-10-05 · 가져온 날 2026-10-05
그래프에는 같은 모델의 추론 설정(high·max 등) 중 가장 높은 하나만 표시합니다. 표에는 설정별 순위가 모두 나옵니다.
표로 보기 (상위 60개)
| 순위 | 모델 | 만든 곳 | 점수 |
|---|---|---|---|
| 1 | #1Claude Opus 5.5 (Max, Default Fallback) | Anthropic | 57.6 |
| 2 | #2Claude Sonnet 5.5 (Max, Default Fallback) | Anthropic | 56 |
| 3 | #3Claude Fable 5.1 (Max, Default Fallback) | Anthropic | 53.4 |
| 4 | #4Qwen3.8 Max | Alibaba | 53.4 |
| 5 | #5OGPT-6 Astra (max) | OpenAI | 52.7 |
| 6 | #6OGPT-6.1 Sol (max) | OpenAI | 51.8 |
| 7 | #7Claude Opus 5 (Max) | Anthropic | 50.8 |
| 8 | #8Claude Fable 5 (Max, Opus 4.8 Fallback) | Anthropic | 49.6 |
| 9 | #9OGPT-6 Sol (Max) | OpenAI | 47.6 |
| 10 | #10OGPT-5.6 Sol (Max) | OpenAI | 47 |
| 11 | #11xGrok 4.7 (Xhigh) | xAI | 46.4 |
| 12 | #12MiMo-V2.6-Pro | Xiaomi | 46.3 |
| 13 | #13Qwen3.8 Max (0902) | Alibaba | 45.4 |
| 14 | #14ZGLM-5.3 (Max) | Z.ai | 44.8 |
| 15 | #15xGrok 4.6 (High) | xAI | 44.3 |
| 16 | #16Kimi K3 (Max) | Moonshot AI | 43.6 |
| 17 | #17OGPT-5.6 Terra (Max) | OpenAI | 42.1 |
| 18 | #18Claude Opus 4.8 (Max) | Anthropic | 41.8 |
| 19 | #19ZGLM 5.3 Flash | Z.ai | 41.8 |
| 20 | #20iLing 3.1 Flash | inclusionAI | 41.1 |
| 21 | #21Gemini 3.8 Flash (High) | 40.9 | |
| 22 | #22Qwen3.8 2.4T A95B | Alibaba | 39.9 |
| 23 | #23Muse Spark 1.2 (Xhigh) | Meta | 39.6 |
| 24 | #24DeepSeek V4.1 Flash (Reasoning, Max Effort) | DeepSeek | 39.5 |
| 25 | #25Gemini 3.7 Flash (High) | 39.1 | |
| 26 | #26xGrok 4.5 (High) | xAI | 38.8 |
| 27 | #27OGPT-5.5 (Xhigh) | OpenAI | 38.4 |
| 28 | #28Claude Sonnet 5 (Max) | Anthropic | 38.2 |
| 29 | #29OGPT-6 Luna (Max) | OpenAI | 38.1 |
| 30 | #30MiMo-V2.6-Flash | Xiaomi | 37.9 |
| 31 | #31OGPT-5.6 Luna (Max) | OpenAI | 37.3 |
| 32 | #32DeepSeek V4 Pro 0813 (Max) | DeepSeek | 36 |
| 33 | #33DeepSeek V4 Flash 0731 (Max) | DeepSeek | 34.3 |
| 34 | #34Gemini 3.6 Flash (High) | 34 | |
| 35 | #35Muse Spark 1.1 (Xhigh) | Meta | 33.7 |
| 36 | #36ZGLM-5.2 (Max) | Z.ai | 33.7 |
| 37 | #37Qwen3.8 27B (Xhigh) | Alibaba | 33.7 |
| 38 | #38Gemini 3.5 Flash (High) | 32.6 | |
| 39 | #39DeepSeek V4 Pro 0424 (Max) | DeepSeek | 30.4 |
| 40 | #40Claude Sonnet 4.6 (Max) | Anthropic | 30.1 |
| 41 | #41Gemini 3.1 Pro Preview | 29.7 | |
| 42 | #42Qwen3.7 Max | Alibaba | 29.5 |
| 43 | #43MiniMax-M3 | MiniMax | 29.2 |
| 44 | #44Kimi K2.6 (Reasoning) | Moonshot AI | 27 |
| 45 | #45ZGLM-5.1 (Reasoning) | Z.ai | 26.1 |
| 46 | #46MiMo-V2.5-Pro (Reasoning) | Xiaomi | 26 |
| 47 | #47Kimi K2.7 Code | Moonshot AI | 25.8 |
| 48 | #48TInkling Small | Thinkingmachines | 25.7 |
| 49 | #49THy3 | Tencent | 25.3 |
| 50 | #50Qwen3.7 Plus | Alibaba | 25.2 |
| 51 | #51TInkling (Xhigh) | Thinkingmachines | 25 |
| 52 | #52xGrok 4.3 (High) | xAI | 24.9 |
| 53 | #53iLing-3.0-flash-VL | inclusionAI | 24.6 |
| 54 | #54DeepSeek V4 Flash 0420 (High) | DeepSeek | 24.4 |
| 55 | #55OGPT-5.4 mini (Xhigh) | OpenAI | 24.1 |
| 56 | #56USolar Mini 4 | Upstage | 24.1 |
| 57 | #57Nemotron 3 Ultra 550B A55B (Reasoning) | NVIDIA | 22.9 |
| 58 | #58MiniMax-M2.7 | MiniMax | 22.8 |
| 59 | #59iLing-3.0-flash-Fin | inclusionAI | 22.6 |
| 60 | #60Gemini 3.5 Flash-Lite | 22.2 |
Source: Artificial Analysis (artificialanalysis.ai) via OpenRouter (openrouter.ai/rankings). Licensed under CC BY 4.0.
데이터: LMArena leaderboard dataset (CC BY 4.0). 변경: 각 순위표의 상위 50개만 표시, 점수는 반올림. https://huggingface.co/datasets/lmarena-ai/leaderboard-dataset회사 로고는 각 회사의 상표이며 구분을 돕기 위해서만 씁니다(아이콘: Simple Icons).데이터: Epoch AI — Capabilities & benchmarking (CC BY 4.0). https://epoch.ai/benchmarksSource: Artificial Analysis (artificialanalysis.ai) via OpenRouter (openrouter.ai/rankings). Source: OpenRouter evals (openrouter.ai) via OpenRouter (openrouter.ai/rankings). Source: Design Arena (www.designarena.ai) via OpenRouter (openrouter.ai/rankings). Licensed under CC BY 4.0. Source: OpenRouter (openrouter.ai/rankings), as of 2026-10-05. Licensed under CC BY 4.0. https://openrouter.ai/rankings