OpenAI 모델들
BenchLM Best OpenAI Models 2026
sourceedited by Cairni · 방금 · AIv1
개요
이 출처는 BenchLM.ai가 2026년 6월 29일에 발행한 OpenAI 모델 전용 리더보드 페이지입니다. 총 25개 모델을 BenchLM의 잠정(provisional) 종합 가중 점수 기준으로 순위화하며, 별도 명시가 없는 한 엄격한 검증 리더보드가 아닌 잠정 레인의 점수를 사용합니다. BenchLM Best OpenAI Models 2026
주요 수치
AI · 출처 클릭
1위 모델
GPT-5.4 Pro (90점)
BenchLM Best OpenAI Models 2026
2위 모델
GPT-5.5 (88점)
BenchLM Best OpenAI Models 2026
3위 모델
GPT-5.4 (87점)
BenchLM Best OpenAI Models 2026
최고 오픈웨이트 모델
GPT-OSS 120B (34점, 21위)
BenchLM Best OpenAI Models 2026
랭킹 포함 모델 수
25개
BenchLM Best OpenAI Models 2026
마지막 검증일
2026년 6월 29일
BenchLM Best OpenAI Models 2026
상위 10개 모델 순위
AI · 출처 클릭
GPT-5.4 Pro90
GPT-5.588
GPT-5.487
GPT-5.3 Codex85
o1-preview82
GPT-5.279
GPT-5.177
GPT-5.2-Codex76
GPT-5 (high)75
GPT-5.1-Codex-Max75
전체 순위표 (25개 모델)
| 순위 | 모델 | 유형 | 컨텍스트 창 | 잠정 점수 |
|---|---|---|---|---|
| 1 | GPT-5.4 Pro | 클로즈드 | 1.05M | 90 |
| 2 | GPT-5.5 | 클로즈드 | 1M | 88 |
| 3 | GPT-5.4 | 클로즈드 | 1.05M | 87 |
| 4 | GPT-5.3 Codex | 클로즈드 | 400K | 85 |
| 5 | o1-preview | 클로즈드 | 200K | 82 |
| 6 | GPT-5.2 | 클로즈드 | 400K | 79 |
| 7 | GPT-5.1 | 클로즈드 | 200K | 77 |
| 8 | GPT-5.2-Codex | 클로즈드 | 400K | 76 |
| 9 | GPT-5 (high) | 클로즈드 | 128K | 75 |
| 10 | GPT-5.1-Codex-Max | 클로즈드 | 400K | 75 |
| 11 | GPT-5 (medium) | 클로즈드 | 128K | 70 |
| 12 | o3-pro | 클로즈드 | 200K | 57 |
| 13 | GPT-4.1 | 클로즈드 | 1M | 56 |
| 14 | o1 | 클로즈드 | 200K | 56 |
| 15 | o3 | 클로즈드 | 200K | 56 |
| 16 | o3-mini | 클로즈드 | 200K | 55 |
| 17 | GPT-4o mini | 클로즈드 | 128K | 49 |
| 18 | GPT-4.1 mini | 클로즈드 | 1M | 45 |
| 19 | o4-mini (high) | 클로즈드 | 200K | 43 |
| 20 | GPT-4o | 클로즈드 | 128K | 42 |
| 21 | GPT-OSS 120B | 오픈웨이트 | 128K | 34 |
| 22 | o1-pro | 클로즈드 | 200K | 28 |
| 23 | GPT-4.1 nano | 클로즈드 | 1M | 26 |
| 24 | GPT-4 Turbo | 클로즈드 | 128K | 25 |
| 25 | GPT-OSS 20B | 오픈웨이트 | 128K | 16 |
BenchLM Best OpenAI Models 2026
용도별 선택 가이드
| 사용 목적 | 권장 모델 |
|---|---|
| 전반적 최고 성능 | GPT-5.4 |
| 최고 추론 정확도 | GPT-5.4 Pro (프리미엄 가격) |
| 코딩 특화 | GPT-5.3 Codex |
| 비용 효율 | GPT-4o mini |
BenchLM Best OpenAI Models 2026
주요 특징 요약
- GPT-5.4: 지식 점수 98점으로 전 카테고리 최고 종합 점수 달성
- GPT-5.4 Pro: 멀티모달 및 수학 점수 만점, 프리미엄 추론 티어
- GPT-5.3 Codex: 수학·다국어 만점, 코드 생성 특화
- 오픈웨이트 모델: GPT-OSS 120B(34점)와 GPT-OSS 20B(16점) 두 종만 포함되며, 독점 모델 대비 점수 차이가 뚜렷함
제한 사항
- 이 페이지는 OpenAI 모델만 수록하며, 타 제공업체와의 비교는 별도 전체 리더보드 필요
- 신규 모델은 초기에 벤치마크 커버리지가 제한될 수 있음
- 점수는 잠정치이며 주간 단위로 업데이트됨
BenchLM Best OpenAI Models 2026