Valumigo

GPT-6.1 Sol

OpenAI · 2026-09-29

기본 정보

만든 곳
OOpenAI
출시일
2026-09-29
종합 능력 지수(ECI)
아직 측정되지 않음

공식 영상

OpenAI DevDay 2026 Keynote (FULL) · OpenAI

시험 점수 (Epoch AI)

시험마다 평가된 모델 중 몇 위인지 함께 보여 줍니다.

O박사급 과학 문제 (GPQA Diamond) · 30개 중 3위
95.4%
O최고 난도 수학 (FrontierMath) · 30개 중 1위
93.7%
O사실 질문 정확도 (SimpleQA Verified) · 30개 중 2위
73.9%

막대는 정답률(%)입니다. 0%부터 그립니다.

사용자 투표 순위 (LMArena)

사람들이 두 모델의 답을 비교해 투표한 순위입니다. 아직 투표가 부족한 순위표에는 나오지 않습니다.

  • 종합413개 중 21위 · 1483
  • 에이전트 작업 성공50개 중 2위 · 0.155
  • 웹 개발50개 중 4위 · 1758
  • 에이전트 종합50개 중 5위 · 0.112
  • 코딩408개 중 8위 · 1542
  • 이미지 이해(비전)50개 중 10위 · 1291
  • 영어413개 중 13위 · 1496
  • 창작 글쓰기411개 중 27위 · 1460
  • 중국어389개 중 59위 · 1500

어디서 쓸 수 있나

OpenAI의 모델은 주로 ChatGPT에서 쓸 수 있습니다. 요금제마다 쓸 수 있는 모델과 사용량이 다르니 요금·무료 범위 페이지에서 확인하세요.

ChatGPT 요금·무료 범위 보기 →

실측 기록

1차 과제가 너무 쉬웠다는 지적을 반영해, 작은 쇼핑몰 코드에서 여러 파일 버그·명세 기반 기능·동시성 버그를 시켰습니다. 18회 실행 기록과 과제 파일을 공개합니다.

Claude Code vs Codex 2차: 여러 파일짜리 실무형 과제 3개를 3번씩 시켜 봤습니다
점수와 순위는 공개 자료를 그대로 옮긴 것이며 이 사이트가 직접 측정한 값이 아닙니다. 모델 이름이 자료마다 조금씩 달라 자동으로 맞춘 결과이므로, 드물게 다른 버전과 섞일 수 있습니다.

출처: Epoch AI (CC BY 4.0) · 확인 2026-10-04 · LMArena (CC BY 4.0) · 확인 2026-10-04