GPT-6.1 Sol
OpenAI · 2026-09-29
기본 정보
- 만든 곳
- OOpenAI
- 출시일
- 2026-09-29
- 종합 능력 지수(ECI)
- 아직 측정되지 않음
공식 영상
시험 점수 (Epoch AI)
시험마다 평가된 모델 중 몇 위인지 함께 보여 줍니다.
O박사급 과학 문제 (GPQA Diamond) · 30개 중 3위
95.4%
O최고 난도 수학 (FrontierMath) · 30개 중 1위
93.7%
O사실 질문 정확도 (SimpleQA Verified) · 30개 중 2위
73.9%
막대는 정답률(%)입니다. 0%부터 그립니다.
사용자 투표 순위 (LMArena)
사람들이 두 모델의 답을 비교해 투표한 순위입니다. 아직 투표가 부족한 순위표에는 나오지 않습니다.
- 종합413개 중 21위 · 1483
- 에이전트 작업 성공50개 중 2위 · 0.155
- 웹 개발50개 중 4위 · 1758
- 에이전트 종합50개 중 5위 · 0.112
- 코딩408개 중 8위 · 1542
- 이미지 이해(비전)50개 중 10위 · 1291
- 영어413개 중 13위 · 1496
- 창작 글쓰기411개 중 27위 · 1460
- 중국어389개 중 59위 · 1500
어디서 쓸 수 있나
OpenAI의 모델은 주로 ChatGPT에서 쓸 수 있습니다. 요금제마다 쓸 수 있는 모델과 사용량이 다르니 요금·무료 범위 페이지에서 확인하세요.
실측 기록
1차 과제가 너무 쉬웠다는 지적을 반영해, 작은 쇼핑몰 코드에서 여러 파일 버그·명세 기반 기능·동시성 버그를 시켰습니다. 18회 실행 기록과 과제 파일을 공개합니다.
Claude Code vs Codex 2차: 여러 파일짜리 실무형 과제 3개를 3번씩 시켜 봤습니다점수와 순위는 공개 자료를 그대로 옮긴 것이며 이 사이트가 직접 측정한 값이 아닙니다. 모델 이름이 자료마다 조금씩 달라 자동으로 맞춘 결과이므로, 드물게 다른 버전과 섞일 수 있습니다.
출처: Epoch AI (CC BY 4.0) · 확인 2026-10-04 · LMArena (CC BY 4.0) · 확인 2026-10-04