Valumigo

Claude Opus 5

Anthropic · 2026-07-24

기본 정보

만든 곳
AnthropicAnthropic
출시일
2026-07-24
종합 능력 지수(ECI)
162.9

시험 점수 (Epoch AI)

시험마다 평가된 모델 중 몇 위인지 함께 보여 줍니다.

Anthropic박사급 과학 문제 (GPQA Diamond) · 30개 중 12위
93.9%
Anthropic최고 난도 수학 (FrontierMath) · 30개 중 11위
85.6%
Anthropic처음 보는 퍼즐 추론 (ARC-AGI-2) · 30개 중 4위
90.4%
Anthropic사실 질문 정확도 (SimpleQA Verified) · 30개 중 16위
59.9%
Anthropic컴퓨터 화면 조작 (OSWorld 2.0) · 9개 중 1위
31.4%

막대는 정답률(%)입니다. 0%부터 그립니다.

사용자 투표 순위 (LMArena)

사람들이 두 모델의 답을 비교해 투표한 순위입니다. 아직 투표가 부족한 순위표에는 나오지 않습니다.

  • 종합413개 중 4위 · 1504
  • 한국어278개 중 3위 · 1498
  • 웹 개발50개 중 1위 · 1815
  • 문서 이해44개 중 1위 · 1516
  • 창작 글쓰기411개 중 2위 · 1516
  • 중국어389개 중 2위 · 1571
  • 에이전트 종합50개 중 2위 · 0.138
  • 수학396개 중 3위 · 1521
  • 일본어274개 중 4위 · 1506
  • 에이전트 작업 성공50개 중 4위 · 0.141
  • 영어413개 중 6위 · 1506
  • 독일어307개 중 6위 · 1506
  • 스페인어295개 중 10위 · 1484
  • 코딩408개 중 12위 · 1538
  • 이미지 이해(비전)50개 중 14위 · 1289
  • 프랑스어290개 중 17위 · 1506

어디서 쓸 수 있나

Anthropic의 모델은 주로 Claude에서 쓸 수 있습니다. 요금제마다 쓸 수 있는 모델과 사용량이 다르니 요금·무료 범위 페이지에서 확인하세요.

Claude 요금·무료 범위 보기 →

실측 기록

1차 과제가 너무 쉬웠다는 지적을 반영해, 작은 쇼핑몰 코드에서 여러 파일 버그·명세 기반 기능·동시성 버그를 시켰습니다. 18회 실행 기록과 과제 파일을 공개합니다.

Claude Code vs Codex 2차: 여러 파일짜리 실무형 과제 3개를 3번씩 시켜 봤습니다
점수와 순위는 공개 자료를 그대로 옮긴 것이며 이 사이트가 직접 측정한 값이 아닙니다. 모델 이름이 자료마다 조금씩 달라 자동으로 맞춘 결과이므로, 드물게 다른 버전과 섞일 수 있습니다.

출처: Epoch AI (CC BY 4.0) · 확인 2026-10-04 · LMArena (CC BY 4.0) · 확인 2026-10-04