Valumigo

LMArena · 코딩

공개된 벤치마크 자료(LMArena 사용자 투표 순위, Epoch AI 시험 점수, OpenRouter 사용량 순위)를 정기적으로 받아 보여 줍니다. 각 순위표의 공개일과 가져온 날을 함께 표시합니다. 이 사이트가 직접 매긴 점수가 아닙니다.

LMArena 점수는 사람들이 두 모델의 답을 나란히 보고 더 나은 쪽에 투표한 결과(Elo 방식)입니다. 점수 차이가 신뢰 구간 안이면 사실상 비슷한 수준으로 보세요.

이 순위표 읽는 법

무엇을 재나: LMArena의 텍스트 대화 중 코딩 관련 질문으로 분류된 투표를 이용해 계산한 순위입니다.

점수 읽는 법: 코딩 관련 답변에서 사용자가 더 선호한 모델의 상대 점수입니다. 작은 점수 차이는 신뢰 구간과 투표 수를 함께 확인해 해석하세요.

주의할 점: 코딩 대화의 선호 평가이므로 저장소를 실제로 수정하고 테스트하는 에이전트 평가와 구분하세요. SWE-bench·Terminal-Bench와 공개된 실측 결과도 함께 확인하세요.

이번 순위에서 읽을 점

  • 1위 gemini-4-argon-high와 2위 claude-fable-5-high의 95% 신뢰 구간이 겹칩니다. 이 집계만으로 두 모델의 순서를 확정하기는 어렵습니다.
  • 1위와 신뢰 구간이 겹치는 모델이 14개 더 있습니다. 작은 순위 차이는 투표 수와 함께 신중히 해석하세요.
  • 상위 10개 중 Anthropic 모델이 5개로 가장 많습니다.
  • 1위 모델이 받은 투표는 1,230표이고, 이 순위표에는 모델 408개가 있습니다.

코딩 LMArena

공개일 2026-10-02 · 가져온 날 2026-10-04

15001520154015601580
Googlegemini-4-argon-high
1560
Anthropicclaude-fable-5-high
1552
Anthropicclaude-opus-4-6-high
1551
Anthropicclaude-opus-4-7-high
1551
Ogpt-6-astra-max
1543
Ogpt-6.1-sol-max
1542
Moonshot AIkimi-k3-max
1541
Xiaomimimo-v2.6-pro
1540
Metamuse-spark-1.3-max
1539
Anthropicclaude-opus-5.5-high
1538
Anthropicclaude-sonnet-5.5-xhigh
1536
Ogpt-5.6-sol-xhigh
1534
Anthropicclaude-opus-5-high
1533
Anthropicclaude-opus-4-8-high
1533
Metamuse-spark-1.1
1533
Metamuse-spark-1.2 (xHigh)
1531
Anthropicclaude-fable-5.1-max
1531
Anthropicclaude-opus-4-5-20251101-high-32k
1530
Googlegemini-3.8-flash-high
1530
Metamuse-spark
1530

점은 점수, 가로선은 95% 신뢰 구간입니다. 선이 겹치면 사실상 비슷한 수준입니다. 그래프에는 같은 모델의 추론 설정(high·max 등) 중 가장 높은 하나만 표시합니다. 표에는 설정별 순위가 모두 나옵니다. 대화·비전 순위는 LMArena 사이트의 기본값과 같은 '말투·길이 보정(style control)' 순위입니다.

회사별 최고 순위

  • GoogleGooglegemini-4-argon-high#1
  • AnthropicAnthropicclaude-fable-5-high#2
  • OOpenAIgpt-6-astra-max#7
  • Moonshot AIMoonshot AIkimi-k3-max#9
  • XiaomiXiaomimimo-v2.6-pro#10
  • MetaMetamuse-spark-1.3-max#11
  • DeepSeekDeepSeekdeepseek-v4.1-flash-max#26
  • AlibabaAlibabaqwen3.7-max-preview#27
  • ZZ.aiglm-5.3-flash#29
표로 보기 (상위 50개)
순위모델만든 곳점수95% 신뢰 구간투표 수
1#1Googlegemini-4-argon-highGoogle15601543–15771,230
2#2Anthropicclaude-fable-5-highAnthropic15521545–155910,038
3#3Anthropicclaude-opus-4-6-highAnthropic15511546–155720,235
4#4Anthropicclaude-opus-4-7-highAnthropic15511545–155618,521
5#5Anthropicclaude-opus-4-6Anthropic15481542–155322,901
6#6Anthropicclaude-opus-4-7Anthropic15461541–155218,728
7#7Ogpt-6-astra-maxOpenAI15431530–15562,135
8#8Ogpt-6.1-sol-maxOpenAI15421518–1566609
9#9Moonshot AIkimi-k3-maxMoonshot AI15411533–15497,285
10#10Xiaomimimo-v2.6-proXiaomi15401522–15581,103
11#11Metamuse-spark-1.3-maxMeta15391528–15493,307
12#12Anthropicclaude-opus-5.5-highAnthropic15381521–15561,060
13#13Anthropicclaude-sonnet-5.5-xhighAnthropic15361515–1558779
14#14Ogpt-5.6-sol-xhighOpenAI15341527–15419,943
15#15Anthropicclaude-opus-5-highAnthropic15331527–154015,559
16#16Anthropicclaude-opus-4-8-highAnthropic15331527–153917,395
17#17Metamuse-spark-1.1Meta15331526–153910,537
18#18Metamuse-spark-1.2 (xHigh)Meta15311514–15491,222
19#19Anthropicclaude-fable-5.1-maxAnthropic15311519–15442,358
20#20Anthropicclaude-opus-4-5-20251101-high-32kAnthropic15301523–15387,793
21#21Anthropicclaude-opus-5-maxAnthropic15301522–15387,382
22#22Googlegemini-3.8-flash-highGoogle15301522–15387,067
23#23Anthropicclaude-opus-4-8Anthropic15301524–153518,024
24#24Metamuse-sparkMeta15301520–15403,930
25#25Anthropicclaude-sonnet-4-6Anthropic15291523–153419,686
26#26DeepSeekdeepseek-v4.1-flash-maxDeepSeek15281516–15402,469
27#27Alibabaqwen3.7-max-previewAlibaba15241506–15421,165
28#28Alibabaqwen3.8-maxAlibaba15241516–15326,611
29#29Zglm-5.3-flashZ.ai15231515–15326,157
30#30Anthropicclaude-opus-4-5-20251101Anthropic15231518–152817,962
31#31Googlegemini-3.1-pro-previewGoogle15221517–152633,581
32#32Xiaomimimo-v2.5-proXiaomi15221516–152719,324
33#33Xiaomimimo-v2.6-flashXiaomi15211506–15371,508
34#34Zglm-5.3-maxZ.ai15211511–15304,424
35#35Ogpt-5.4-highOpenAI15211515–152717,566
36#36Ogpt-6-sol-maxOpenAI15201507–15342,071
37#37Anthropicclaude-sonnet-4-5-20250929-high-32kAnthropic15191514–152419,905
38#38Googlegemini-3.6-flash-highGoogle15191512–152610,350
39#39Anthropicclaude-sonnet-5-highAnthropic15191512–152512,377
40#40Ogpt-5.5-highOpenAI15191513–152419,110
41#41Googlegemini-3.7-flash-highGoogle15181510–15266,041
42#42Googlegemini-3-proGoogle15181511–15258,787
43#43Moonshot AIkimi-k2.6Moonshot AI15161509–152311,062
44#44Ogpt-5.6-terra-xhighOpenAI15151508–152210,166
45#45Ogpt-5.2-chat-latest-20260210OpenAI15151508–15229,629
46#46xgrok-4.5xAI15141507–152111,055
47#47ByteDancedola-seed-2.0-proByteDance15141509–151921,996
48#48Alibabaqwen3.5-max-previewAlibaba15141506–15226,358
49#49Ogpt-5.5-instantOpenAI15131506–15217,909
50#50Zglm-5.1Z.ai15131507–151816,060

데이터: LMArena leaderboard dataset (CC BY 4.0). 변경: 각 순위표의 상위 50개만 표시, 점수는 반올림. https://huggingface.co/datasets/lmarena-ai/leaderboard-dataset회사 로고는 각 회사의 상표이며 구분을 돕기 위해서만 씁니다(아이콘: Simple Icons).데이터: Epoch AI — Capabilities & benchmarking (CC BY 4.0). https://epoch.ai/benchmarksSource: OpenRouter (openrouter.ai/rankings), as of 2026-10-04. Licensed under CC BY 4.0. https://openrouter.ai/rankings