Valumigo

LMArena · 웹 개발

공개된 벤치마크 자료(LMArena 사용자 투표 순위, Epoch AI 시험 점수, OpenRouter 사용량 순위)를 정기적으로 받아 보여 줍니다. 각 순위표의 공개일과 가져온 날을 함께 표시합니다. 이 사이트가 직접 매긴 점수가 아닙니다.

LMArena 점수는 사람들이 두 모델의 답을 나란히 보고 더 나은 쪽에 투표한 결과(Elo 방식)입니다. 점수 차이가 신뢰 구간 안이면 사실상 비슷한 수준으로 보세요.

이 순위표 읽는 법

무엇을 재나: 같은 요청으로 웹페이지나 웹앱을 생성하게 하고, 실행된 결과를 익명으로 비교해 투표한 WebDev Arena 순위입니다.

점수 읽는 법: 사용자가 더 선호한 실행 결과의 상대 점수입니다. 객관적인 기능 테스트 통과율이나 유지보수 점수는 아닙니다.

주의할 점: 지원 프레임워크와 생성·실행 조건에 한정된 평가이므로 대규모 프로젝트의 장기 유지보수 능력까지 보장하지는 않습니다.

이번 순위에서 읽을 점

  • 1위 claude-opus-5.5-max와 2위 gpt-6-astra-max의 95% 신뢰 구간이 겹치지 않습니다. 이번 집계에서는 1위가 앞선다는 근거가 비교적 분명합니다.
  • 상위 10개 중 Anthropic 모델이 5개로 가장 많습니다.
  • 1위 모델이 받은 투표는 2,062표이고, 이 순위표에는 모델 50개가 있습니다.

웹 개발 LMArena

공개일 2026-10-01 · 가져온 날 2026-10-04

156016201680174018001860
Anthropicclaude-opus-5.5-max
1815
Ogpt-6-astra-max
1788
Anthropicclaude-sonnet-5.5-xhigh
1786
Ogpt-6.1-sol-max
1758
Anthropicclaude-fable-5.1-max
1749
Anthropicclaude-opus-5-max
1695
Ogpt-6-sol-max
1689
Googlegemini-4-argon-high
1680
Alibabaqwen3.8-max
1671
Alibabaqwen3.8-max-0902
1670
Moonshot AIkimi-k3-max
1658
Metamuse-spark-1.3-max
1657
xgrok-4.7-xhigh
1638
Alibabaqwen3.8-flash-next
1637
Thy4-preview
1633
Anthropicclaude-fable-5-high
1625
Zglm-5.3-max
1623
DeepSeekdeepseek-v4.1-flash-max
1620
Ogpt-5.6-sol-xhigh (codex-harness)
1620
xgrok-4.6-high
1620

점은 점수, 가로선은 95% 신뢰 구간입니다. 선이 겹치면 사실상 비슷한 수준입니다. 그래프에는 같은 모델의 추론 설정(high·max 등) 중 가장 높은 하나만 표시합니다. 표에는 설정별 순위가 모두 나옵니다.

회사별 최고 순위

  • AnthropicAnthropicclaude-opus-5.5-max#1
  • OOpenAIgpt-6-astra-max#2
  • GoogleGooglegemini-4-argon-high#9
  • AlibabaAlibabaqwen3.8-max#10
  • Moonshot AIMoonshot AIkimi-k3-max#13
  • MetaMetamuse-spark-1.3-max#14
  • xxAIgrok-4.7-xhigh#15
  • TTencenthy4-preview#17
  • ZZ.aiglm-5.3-max#20
표로 보기 (상위 50개)
순위모델만든 곳점수95% 신뢰 구간투표 수
1#1Anthropicclaude-opus-5.5-maxAnthropic18151799–18312,062
2#2Ogpt-6-astra-maxOpenAI17881777–17986,123
3#3Anthropicclaude-sonnet-5.5-xhighAnthropic17861768–18041,531
4#4Ogpt-6.1-sol-maxOpenAI17581741–17751,620
5#5Anthropicclaude-fable-5.1-maxAnthropic17491740–17596,318
6#6Anthropicclaude-sonnet-5.5-highAnthropic17151702–17292,527
7#7Anthropicclaude-opus-5-maxAnthropic16951689–170116,954
8#8Ogpt-6-sol-maxOpenAI16891678–17003,411
9#9Googlegemini-4-argon-highGoogle16801666–16932,422
10#10Alibabaqwen3.8-maxAlibaba16711659–16833,454
11#11Alibabaqwen3.8-max-0902Alibaba16701662–16789,485
12#12Anthropicclaude-opus-5-highAnthropic16601654–166621,506
13#13Moonshot AIkimi-k3-maxMoonshot AI16581651–166416,513
14#14Metamuse-spark-1.3-maxMeta16571648–16657,249
15#15xgrok-4.7-xhighxAI16381626–16493,216
16#16Alibabaqwen3.8-flash-nextAlibaba16371629–16466,193
17#17Thy4-previewTencent16331624–16435,088
18#18Anthropicclaude-fable-5-highAnthropic16251619–163214,126
19#19Metamuse-spark-1.3 (xHigh)Meta16241616–16336,326
20#20Zglm-5.3-maxZ.ai16231615–16317,658
21#21DeepSeekdeepseek-v4.1-flash-maxDeepSeek16201609–16303,960
22#22Ogpt-5.6-sol-xhigh (codex-harness)OpenAI16201614–162617,128
23#23xgrok-4.6-highxAI16201612–16278,315
24#24Xiaomimimo-v2.6-proXiaomi16181606–16312,734
25#25Zglm-5.3-flashZ.ai16161608–162310,355
26#26Zglm-5.2-maxZ.ai16051599–161114,729
27#27Googlegemini-3.7-flash-highGoogle15921584–15999,624
28#28Alibabaqwen3.8-27bAlibaba15911584–159812,388
29#29Googlegemini-3.8-flash-highGoogle15831575–15918,524
30#30DeepSeekdeepseek-v4-pro-high-20260813DeepSeek15831573–15924,882
31#31DeepSeekdeepseek-v4-flash-highDeepSeek15811572–15905,040
32#32Ogpt-6-luna-maxOpenAI15791570–15876,429
33#33Sstep-5-preview-highStepFun15701557–15832,506
34#34Anthropicclaude-opus-4-7-highAnthropic15571552–156317,982
35#35Anthropicclaude-opus-4-8-highAnthropic15561550–156118,908
36#36Anthropicclaude-opus-4-7Anthropic15551550–156118,174
37#37xgrok-4.5xAI15521545–155811,393
38#38Anthropicclaude-opus-4-6-highAnthropic15461540–155119,519
39#39Metamuse-spark-1.1Meta15421534–15498,070
40#40Anthropicclaude-sonnet-5-highAnthropic15391533–154614,130
41#41Anthropicclaude-opus-4-6Anthropic15371532–154220,762
42#42Googlegemini-3.6-flash-highGoogle15361529–15448,823
43#43Anthropicclaude-opus-4-8Anthropic15341528–154017,880
44#44Metamuse-spark-1.2 (xHigh)Meta15321518–15452,183
45#45Anthropicclaude-sonnet-4-6Anthropic15211516–152722,960
46#46Ogpt-5.6-terra-xhigh (codex-harness)OpenAI15191513–152612,526
47#47Ogpt-5.6-luna-xhigh (codex-harness)OpenAI15181512–152412,776
48#48ByteDanceseed-2.1-pro-previewByteDance15171511–152313,312
49#49Alibabaqwen3.7-max-20260517Alibaba15151508–15228,922
50#50Ogpt-5.5-xhigh (codex-harness)OpenAI15121506–151815,873

데이터: LMArena leaderboard dataset (CC BY 4.0). 변경: 각 순위표의 상위 50개만 표시, 점수는 반올림. https://huggingface.co/datasets/lmarena-ai/leaderboard-dataset회사 로고는 각 회사의 상표이며 구분을 돕기 위해서만 씁니다(아이콘: Simple Icons).데이터: Epoch AI — Capabilities & benchmarking (CC BY 4.0). https://epoch.ai/benchmarksSource: OpenRouter (openrouter.ai/rankings), as of 2026-10-04. Licensed under CC BY 4.0. https://openrouter.ai/rankings