Valumigo

LMArena · 창작 글쓰기

공개된 벤치마크 자료(LMArena 사용자 투표 순위, Epoch AI 시험 점수, OpenRouter 사용량 순위)를 정기적으로 받아 보여 줍니다. 각 순위표의 공개일과 가져온 날을 함께 표시합니다. 이 사이트가 직접 매긴 점수가 아닙니다.

LMArena 점수는 사람들이 두 모델의 답을 나란히 보고 더 나은 쪽에 투표한 결과(Elo 방식)입니다. 점수 차이가 신뢰 구간 안이면 사실상 비슷한 수준으로 보세요.

이 순위표 읽는 법

무엇을 재나: LMArena의 텍스트 대화 중 소설·시·카피 등 창작 글쓰기 질문으로 분류된 투표를 이용한 순위입니다.

점수 읽는 법: 창작 글쓰기 질문에서 사용자가 더 선호한 답변의 상대 순위입니다. 재미나 문체를 별도로 객관 채점한 점수는 아닙니다.

주의할 점: 자신의 용도와 문체 취향에 맞는지는 같은 요청으로 직접 비교해 확인하세요.

이번 순위에서 읽을 점

  • 1위 gemini-4-argon-high와 2위 claude-opus-5.5-high의 95% 신뢰 구간이 겹칩니다. 이 집계만으로 두 모델의 순서를 확정하기는 어렵습니다.
  • 1위와 신뢰 구간이 겹치는 모델이 4개 더 있습니다. 작은 순위 차이는 투표 수와 함께 신중히 해석하세요.
  • 상위 10개 중 Anthropic 모델이 6개로 가장 많습니다.
  • 1위 모델이 받은 투표는 1,097표이고, 이 순위표에는 모델 411개가 있습니다.

창작 글쓰기 LMArena

공개일 2026-10-02 · 가져온 날 2026-10-04

14401470150015301560
Googlegemini-4-argon-high
1519
Anthropicclaude-opus-5.5-high
1516
Anthropicclaude-fable-5-high
1503
Anthropicclaude-opus-4-6-high
1501
Googlegemini-3.7-flash-high
1493
Anthropicclaude-opus-4-7-high
1489
Googlegemini-3.8-flash-high
1485
Googlegemini-3-pro
1484
Anthropicclaude-fable-5.1-max
1482
Googlegemini-3.1-pro-preview
1480
Anthropicclaude-opus-5-high
1471
Googlegemini-3.6-flash-high
1471
Anthropicclaude-opus-4-5-20251101-high-32k
1470
Anthropicclaude-opus-4-8-high
1470
Googlegemini-3.5-flash-medium
1469
Ogpt-5.6-sol-xhigh
1468
Alibabaqwen3.8-max
1468
Metamuse-spark
1465
xgrok-4.20-beta1
1463
Anthropicclaude-opus-4-5-20251101
1462

점은 점수, 가로선은 95% 신뢰 구간입니다. 선이 겹치면 사실상 비슷한 수준입니다. 그래프에는 같은 모델의 추론 설정(high·max 등) 중 가장 높은 하나만 표시합니다. 표에는 설정별 순위가 모두 나옵니다. 대화·비전 순위는 LMArena 사이트의 기본값과 같은 '말투·길이 보정(style control)' 순위입니다.

회사별 최고 순위

  • GoogleGooglegemini-4-argon-high#1
  • AnthropicAnthropicclaude-opus-5.5-high#2
  • OOpenAIgpt-5.6-sol-xhigh#19
  • AlibabaAlibabaqwen3.8-max#20
  • MetaMetamuse-spark#21
  • xxAIgrok-4.20-beta1#24
  • Moonshot AIMoonshot AIkimi-k3-max#26
  • ZZ.aiglm-5.2-max#32
  • XiaomiXiaomimimo-v2.6-pro#47
표로 보기 (상위 50개)
순위모델만든 곳점수95% 신뢰 구간투표 수
1#1Googlegemini-4-argon-highGoogle15191499–15381,097
2#2Anthropicclaude-opus-5.5-highAnthropic15161497–15361,058
3#3Anthropicclaude-fable-5-highAnthropic15031495–15108,182
4#4Anthropicclaude-opus-4-6-highAnthropic15011494–150714,085
5#5Googlegemini-3.7-flash-highGoogle14931484–15034,776
6#6Anthropicclaude-opus-4-7-highAnthropic14891482–149611,812
7#7Googlegemini-3.8-flash-highGoogle14851476–14945,697
8#8Googlegemini-3-proGoogle14841476–14936,510
9#9Anthropicclaude-opus-4-7Anthropic14831476–149012,043
10#10Anthropicclaude-fable-5.1-maxAnthropic14821469–14942,645
11#11Googlegemini-3.1-pro-previewGoogle14801475–148622,309
12#12Anthropicclaude-opus-4-6Anthropic14791473–148514,240
13#13Anthropicclaude-opus-5-highAnthropic14711465–147813,263
14#14Googlegemini-3.6-flash-highGoogle14711463–14797,580
15#15Anthropicclaude-opus-5-maxAnthropic14711462–14796,526
16#16Anthropicclaude-opus-4-5-20251101-high-32kAnthropic14701461–14785,676
17#17Anthropicclaude-opus-4-8-highAnthropic14701463–147612,798
18#18Googlegemini-3.5-flash-mediumGoogle14691461–14769,445
19#19Ogpt-5.6-sol-xhighOpenAI14681460–14767,537
20#20Alibabaqwen3.8-maxAlibaba14681458–14784,555
21#21Metamuse-sparkMeta14651452–14792,040
22#22Googlegemini-3.5-flash-highGoogle14641457–14719,476
23#23Anthropicclaude-opus-4-8Anthropic14631457–147012,836
24#24xgrok-4.20-beta1xAI14631453–14734,158
25#25Anthropicclaude-opus-4-5-20251101Anthropic14621456–146811,392
26#26Moonshot AIkimi-k3-maxMoonshot AI14601451–14695,694
27#27Ogpt-6.1-sol-maxOpenAI14601436–1483686
28#28Metamuse-spark-1.3-maxMeta14591446–14712,631
29#29Googlegemini-3-flashGoogle14571448–14664,814
30#30Ogpt-5.5-instantOpenAI14561447–14664,346
31#31Metamuse-spark-1.2 (xHigh)Meta14551435–1476852
32#32Zglm-5.2-maxZ.ai14541447–14628,979
33#33Anthropicclaude-sonnet-4-5-20250929Anthropic14541448–146012,367
34#34Zglm-5.3-maxZ.ai14541444–14644,034
35#35Ogpt-5.5-highOpenAI14511445–145813,120
36#36xgrok-4.5xAI14501443–14588,291
37#37Anthropicclaude-sonnet-4-5-20250929-high-32kAnthropic14501444–145612,644
38#38Anthropicclaude-sonnet-4-6Anthropic14491443–145612,339
39#39Ogpt-6-astra-maxOpenAI14491435–14632,029
40#40Zglm-5Z.ai14491440–14584,837
41#41Ogpt-5.5OpenAI14481442–145513,354
42#42Anthropicclaude-sonnet-5.5-xhighAnthropic14471424–1471658
43#43Metamuse-spark-1.1Meta14471439–14557,706
44#44xgrok-4.20-multi-agent-beta-0309xAI14471440–145411,279
45#45Googlegemini-3-flash (thinking-minimal)Google14471441–145315,198
46#46Zglm-5.1Z.ai14461440–145311,254
47#47Xiaomimimo-v2.6-proXiaomi14461425–1467788
48#48DeepSeekdeepseek-v4-proDeepSeek14461439–14539,721
49#49Anthropicclaude-opus-4-1-20250805-thinking-16kAnthropic14461438–14536,815
50#50xgrok-4.20-beta-0309-reasoningxAI14451439–145211,425

데이터: LMArena leaderboard dataset (CC BY 4.0). 변경: 각 순위표의 상위 50개만 표시, 점수는 반올림. https://huggingface.co/datasets/lmarena-ai/leaderboard-dataset회사 로고는 각 회사의 상표이며 구분을 돕기 위해서만 씁니다(아이콘: Simple Icons).데이터: Epoch AI — Capabilities & benchmarking (CC BY 4.0). https://epoch.ai/benchmarksSource: OpenRouter (openrouter.ai/rankings), as of 2026-10-04. Licensed under CC BY 4.0. https://openrouter.ai/rankings