Valumigo

Artificial Analysis · 코딩 지수

공개된 벤치마크 자료(LMArena 사용자 투표 순위, Epoch AI 시험 점수, OpenRouter 사용량 순위)를 정기적으로 받아 보여 줍니다. 각 순위표의 공개일과 가져온 날을 함께 표시합니다. 이 사이트가 직접 매긴 점수가 아닙니다.

LMArena 점수는 사람들이 두 모델의 답을 나란히 보고 더 나은 쪽에 투표한 결과(Elo 방식)입니다. 점수 차이가 신뢰 구간 안이면 사실상 비슷한 수준으로 보세요.

이 순위표 읽는 법

무엇을 재나: Artificial Analysis가 코딩 관련 평가를 묶어 만든 코딩 지수입니다.

점수 읽는 법: 높을수록 코드 작성·수정 평가에서 좋은 결과를 냈다는 뜻입니다.

주의할 점: 대화형 코딩 평가 결과이므로, 저장소 전체를 다루는 에이전트 작업 능력과는 차이가 있을 수 있습니다. 우리 코딩 실측 기록도 함께 보세요.

이번 순위에서 읽을 점

  • 최고 점수는 Claude Fable 5.1 (Max, Default Fallback)의 81.6입니다.
  • 1위와 5위의 차이는 4.8입니다.
  • 상위 10개 중 Anthropic 모델이 3개로 가장 많습니다.

코딩 지수 Artificial Analysis

공개일 2026-10-05 · 가져온 날 2026-10-05

AnthropicClaude Fable 5.1 (Max, Default Fallback)
81.6
OGPT-5.6 Sol (Xhigh)
78.3
AnthropicClaude Opus 5 (Max)
78.0
OGPT-6 Astra (max)
76.9
xGrok 4.6 (High)
76.8
OGPT-5.6 Terra (Max)
76.7
AnthropicClaude Fable 5 (Max, Opus 4.8 Fallback)
76.5
GoogleGemini 3.8 Flash (High)
76.3
Moonshot AIKimi K3 (Max)
76.2
AlibabaQwen3.8 Max (0902)
76.2
GoogleGemini 3.7 Flash (High)
76.1
OGPT-5.5 (Xhigh)
74.9
ZGLM-5.3 (Max)
74.8
AnthropicClaude Opus 4.8 (Max)
74.3
AnthropicClaude Opus 4.7 (Max)
73.6
xGrok 4.5 (High)
72.4
MetaMuse Spark 1.2 (Xhigh)
72.2
AlibabaQwen3.8 2.4T A95B
71.9
AnthropicClaude Sonnet 5 (Max)
71.5
ZGLM 5.3 Flash
71.5

그래프에는 같은 모델의 추론 설정(high·max 등) 중 가장 높은 하나만 표시합니다. 표에는 설정별 순위가 모두 나옵니다.

표로 보기 (상위 60개)
순위모델만든 곳점수
1#1AnthropicClaude Fable 5.1 (Max, Default Fallback)Anthropic81.6
2#2OGPT-5.6 Sol (Xhigh)OpenAI78.3
3#3AnthropicClaude Opus 5 (Max)Anthropic78
4#4OGPT-6 Astra (max)OpenAI76.9
5#5xGrok 4.6 (High)xAI76.8
6#6OGPT-5.6 Terra (Max)OpenAI76.7
7#7AnthropicClaude Fable 5 (Max, Opus 4.8 Fallback)Anthropic76.5
8#8GoogleGemini 3.8 Flash (High)Google76.3
9#9Moonshot AIKimi K3 (Max)Moonshot AI76.2
10#10AlibabaQwen3.8 Max (0902)Alibaba76.2
11#11GoogleGemini 3.7 Flash (High)Google76.1
12#12OGPT-5.5 (Xhigh)OpenAI74.9
13#13ZGLM-5.3 (Max)Z.ai74.8
14#14AnthropicClaude Opus 4.8 (Max)Anthropic74.3
15#15AnthropicClaude Opus 4.7 (Max)Anthropic73.6
16#16xGrok 4.5 (High)xAI72.4
17#17MetaMuse Spark 1.2 (Xhigh)Meta72.2
18#18AlibabaQwen3.8 2.4T A95BAlibaba71.9
19#19AnthropicClaude Sonnet 5 (Max)Anthropic71.5
20#20ZGLM 5.3 FlashZ.ai71.5
21#21OGPT-5.6 Luna (Max)OpenAI71.4
22#22MetaMuse Spark 1.1 (Xhigh)Meta71.3
23#23OGPT-5.4 (Xhigh)OpenAI71.1
24#24GoogleGemini 3.5 Flash (High)Google70.1
25#25GoogleGemini 3.6 Flash (High)Google69.2
26#26DeepSeekDeepSeek V4 Flash 0731 (Max)DeepSeek69.1
27#27AlibabaQwen3.8 MaxAlibaba68.9
28#28ZGLM-5.2 (Max)Z.ai68.8
29#29GoogleGemini 3.1 Pro PreviewGoogle68.8
30#30DeepSeekDeepSeek V4 Pro 0813 (Max)DeepSeek68.8
31#31AlibabaQwen3.8 27B (Xhigh)Alibaba68.1
32#32AlibabaQwen3.7 MaxAlibaba66
33#33AnthropicClaude Sonnet 4.6 (Max)Anthropic63
34#34Moonshot AIKimi K2.6 (Reasoning)Moonshot AI61.8
35#35Moonshot AIKimi K2.7 CodeMoonshot AI60.8
36#36XiaomiMiMo-V2.5-Pro (Reasoning)Xiaomi60.2
37#37KKAT Coder Pro V2Kwaipilot59.5
38#38DeepSeekDeepSeek V4 Pro 0424 (Max)DeepSeek59.4
39#39NNex-N2-Pro (Based on Qwen3.5-397B-A17B)Nex Agi59.1
40#40THy3Tencent58.8
41#41MiniMaxMiniMax-M3MiniMax58.6
42#42iLing-3.0-flash-VLinclusionAI57
43#43XiaomiMiMo-V2.5Xiaomi56.8
44#44DeepSeekDeepSeek V4 Flash 0420 (Max)DeepSeek56.2
45#45OGPT-5.4 nano (Xhigh)OpenAI56.1
46#46OGPT-5.4 mini (Xhigh)OpenAI56.1
47#47AlibabaQwen3.7 PlusAlibaba55.9
48#48ZGLM-5.1 (Reasoning)Z.ai55.8
49#49iLing-3.0-flash-FininclusionAI55.6
50#50AlibabaQwen3.6 PlusAlibaba54.5
51#51AlibabaQwen3.6 27B (Reasoning)Alibaba53.7
52#52TInkling SmallThinkingmachines52.9
53#53USolar Pro 4Upstage52.7
54#54MiniMaxMiniMax-M2.7MiniMax52.6
55#55AnthropicClaude 4.5 Sonnet (Reasoning)Anthropic52.1
56#56TInkling (Xhigh)Thinkingmachines52.1
57#57xGrok Build 0.1 0616xAI51.5
58#58iLing 3.0 FlashinclusionAI50.6
59#59XiaomiMiMo-V2-Flash (Non-reasoning)Xiaomi49.8
60#60OGPT-5.1 (High)OpenAI49.4

Source: Artificial Analysis (artificialanalysis.ai) via OpenRouter (openrouter.ai/rankings). Licensed under CC BY 4.0.

데이터: LMArena leaderboard dataset (CC BY 4.0). 변경: 각 순위표의 상위 50개만 표시, 점수는 반올림. https://huggingface.co/datasets/lmarena-ai/leaderboard-dataset회사 로고는 각 회사의 상표이며 구분을 돕기 위해서만 씁니다(아이콘: Simple Icons).데이터: Epoch AI — Capabilities & benchmarking (CC BY 4.0). https://epoch.ai/benchmarksSource: Artificial Analysis (artificialanalysis.ai) via OpenRouter (openrouter.ai/rankings). Source: OpenRouter evals (openrouter.ai) via OpenRouter (openrouter.ai/rankings). Source: Design Arena (www.designarena.ai) via OpenRouter (openrouter.ai/rankings). Licensed under CC BY 4.0. Source: OpenRouter (openrouter.ai/rankings), as of 2026-10-05. Licensed under CC BY 4.0. https://openrouter.ai/rankings