LMArena · 중국어
공개된 벤치마크 자료(LMArena 사용자 투표 순위, Epoch AI 시험 점수, OpenRouter 사용량 순위)를 정기적으로 받아 보여 줍니다. 각 순위표의 공개일과 가져온 날을 함께 표시합니다. 이 사이트가 직접 매긴 점수가 아닙니다.
이 순위표 읽는 법
무엇을 재나: LMArena의 텍스트 대화 중 중국어로 분류된 질문의 투표를 이용해 계산한 순위입니다.
점수 읽는 법: 중국어 질문에서 투표 참여자가 더 선호한 모델을 보여 줍니다. 질문 언어가 투표자의 모국어나 신원을 뜻하지는 않습니다.
주의할 점: 언어와 모델에 따라 투표 수와 신뢰 구간 폭이 다릅니다. 새 모델은 투표 수, 업데이트 날짜와 집계 조건을 함께 확인하세요.
이번 순위에서 읽을 점
- 1위 gemini-4-argon-high와 2위 claude-opus-5.5-high의 95% 신뢰 구간이 겹칩니다. 이 집계만으로 두 모델의 순서를 확정하기는 어렵습니다.
- 1위와 신뢰 구간이 겹치는 모델이 10개 더 있습니다. 작은 순위 차이는 투표 수와 함께 신중히 해석하세요.
- 상위 10개 중 Anthropic 모델이 7개로 가장 많습니다.
- 1위 모델이 받은 투표는 352표이고, 이 순위표에는 모델 389개가 있습니다.
중국어 LMArena
공개일 2026-10-02 · 가져온 날 2026-10-04
점은 점수, 가로선은 95% 신뢰 구간입니다. 선이 겹치면 사실상 비슷한 수준입니다. 그래프에는 같은 모델의 추론 설정(high·max 등) 중 가장 높은 하나만 표시합니다. 표에는 설정별 순위가 모두 나옵니다. 대화·비전 순위는 LMArena 사이트의 기본값과 같은 '말투·길이 보정(style control)' 순위입니다.
회사별 최고 순위
- Googlegemini-4-argon-high#1
- Anthropicclaude-opus-5.5-high#2
- Moonshot AIkimi-k3-max#10
- Alibabaqwen3.8-max#11
- OOpenAIgpt-5.6-sol-xhigh#12
- Metamuse-spark-1.1#17
- ZZ.aiglm-5.3-max#19
- DeepSeekdeepseek-v4.1-flash-max#29
- Xiaomimimo-v2.5-pro#39
표로 보기 (상위 50개)
| 순위 | 모델 | 만든 곳 | 점수 | 95% 신뢰 구간 | 투표 수 |
|---|---|---|---|---|---|
| 1 | #1gemini-4-argon-high | 1587 | 1555–1619 | 352 | |
| 2 | #2claude-opus-5.5-high | Anthropic | 1571 | 1542–1601 | 402 |
| 3 | #3claude-fable-5.1-max | Anthropic | 1570 | 1549–1591 | 874 |
| 4 | #4claude-fable-5-high | Anthropic | 1555 | 1544–1567 | 2,852 |
| 5 | #5claude-opus-4-6-high | Anthropic | 1551 | 1542–1560 | 5,342 |
| 6 | #6claude-opus-5-max | Anthropic | 1548 | 1535–1562 | 2,274 |
| 7 | #7claude-opus-5-high | Anthropic | 1548 | 1538–1558 | 4,718 |
| 8 | #8gemini-3.7-flash-high | 1546 | 1532–1561 | 1,681 | |
| 9 | #9claude-opus-4-6 | Anthropic | 1544 | 1535–1553 | 5,582 |
| 10 | #10kimi-k3-max | Moonshot AI | 1540 | 1527–1554 | 2,051 |
| 11 | #11qwen3.8-max | Alibaba | 1538 | 1523–1553 | 1,712 |
| 12 | #12Ogpt-5.6-sol-xhigh | OpenAI | 1538 | 1526–1550 | 2,823 |
| 13 | #13claude-opus-4-7-high | Anthropic | 1537 | 1528–1547 | 4,149 |
| 14 | #14gemini-3.8-flash-high | 1536 | 1522–1550 | 2,061 | |
| 15 | #15claude-opus-4-7 | Anthropic | 1534 | 1524–1544 | 4,133 |
| 16 | #16claude-sonnet-5.5-xhigh | Anthropic | 1533 | 1497–1568 | 244 |
| 17 | #17muse-spark-1.1 | Meta | 1531 | 1519–1542 | 2,943 |
| 18 | #18muse-spark-1.3-max | Meta | 1531 | 1511–1550 | 939 |
| 19 | #19Zglm-5.3-max | Z.ai | 1531 | 1514–1547 | 1,328 |
| 20 | #20gemini-3.6-flash-high | 1530 | 1518–1542 | 2,712 | |
| 21 | #21Zglm-5.3-flash | Z.ai | 1529 | 1513–1544 | 1,648 |
| 22 | #22gemini-3.1-pro-preview | 1529 | 1521–1536 | 8,287 | |
| 23 | #23muse-spark-1.2 (xHigh) | Meta | 1528 | 1497–1559 | 382 |
| 24 | #24qwen3.7-max-preview | Alibaba | 1527 | 1491–1562 | 309 |
| 25 | #25Ogpt-5.5 | OpenAI | 1526 | 1517–1536 | 4,451 |
| 26 | #26claude-opus-4-8 | Anthropic | 1526 | 1516–1536 | 4,394 |
| 27 | #27claude-opus-4-8-high | Anthropic | 1526 | 1516–1535 | 4,356 |
| 28 | #28muse-spark | Meta | 1525 | 1505–1545 | 965 |
| 29 | #29deepseek-v4.1-flash-max | DeepSeek | 1523 | 1500–1546 | 672 |
| 30 | #30Zglm-5.2-max | Z.ai | 1520 | 1510–1531 | 3,261 |
| 31 | #31gemini-3-pro | 1520 | 1510–1531 | 3,444 | |
| 32 | #32gemini-3.5-flash-medium | 1517 | 1507–1528 | 3,451 | |
| 33 | #33Ogpt-5.5-high | OpenAI | 1517 | 1507–1527 | 4,469 |
| 34 | #34qwen3.5-max-preview | Alibaba | 1516 | 1501–1532 | 1,575 |
| 35 | #35Ogpt-5.6-terra-xhigh | OpenAI | 1516 | 1505–1528 | 2,949 |
| 36 | #36gemini-3-flash | 1516 | 1504–1529 | 2,466 | |
| 37 | #37Zglm-5 | Z.ai | 1516 | 1503–1530 | 2,001 |
| 38 | #38kimi-k2.6 | Moonshot AI | 1516 | 1503–1529 | 2,326 |
| 39 | #39mimo-v2.5-pro | Xiaomi | 1515 | 1505–1524 | 4,455 |
| 40 | #40gemini-3.5-flash-high | 1515 | 1504–1525 | 3,640 | |
| 41 | #41Zglm-5.1 | Z.ai | 1514 | 1504–1524 | 4,041 |
| 42 | #42mimo-v2.6-pro | Xiaomi | 1511 | 1478–1543 | 297 |
| 43 | #43Ogpt-6-astra-max | OpenAI | 1510 | 1488–1532 | 674 |
| 44 | #44xgrok-4.20-beta1 | xAI | 1510 | 1495–1525 | 1,726 |
| 45 | #45Thy3 | Tencent | 1509 | 1489–1530 | 779 |
| 46 | #46claude-sonnet-4-6 | Anthropic | 1509 | 1500–1519 | 4,501 |
| 47 | #47xgrok-4.7-xhigh | xAI | 1507 | 1482–1532 | 531 |
| 48 | #48Ogpt-5.4-high | OpenAI | 1507 | 1497–1517 | 4,132 |
| 49 | #49Ogpt-5.5-instant | OpenAI | 1506 | 1490–1521 | 1,693 |
| 50 | #50xgrok-4.5 | xAI | 1504 | 1493–1516 | 3,061 |
데이터: LMArena leaderboard dataset (CC BY 4.0). 변경: 각 순위표의 상위 50개만 표시, 점수는 반올림. https://huggingface.co/datasets/lmarena-ai/leaderboard-dataset회사 로고는 각 회사의 상표이며 구분을 돕기 위해서만 씁니다(아이콘: Simple Icons).데이터: Epoch AI — Capabilities & benchmarking (CC BY 4.0). https://epoch.ai/benchmarksSource: OpenRouter (openrouter.ai/rankings), as of 2026-10-04. Licensed under CC BY 4.0. https://openrouter.ai/rankings