OpenAI 모델 완전 가이드 (GPT-3.5 ~ GPT-5.6)
OpenAI의 언어 모델 생태계는 2022년 11월 ChatGPT 출시 이후 불과 3~4년 만에 GPT-3.5라는 단일 모델에서 수십 개의 모델 변형·특수 모델·추론 모델로 구성된 방대한 포트폴리오로 성장했다. 오늘날 개발자와 기업은 플래그십 모델, 경량 모델, 코딩 특화 모델, 추론 특화 모델, 오픈웨이트 모델, 멀티모달 모델 등 서로 다른 성능·비용·지원 수명을 가진 수십 가지 선택지를 앞에 두고 있다. 이 문서는 OpenAI GPT 모델 세대별 진화의 역사적 맥락부터 2026년 현재의 BenchLM 순위, API 가격 구조, 그리고 빠르게 진행 중인 지원 중단 및 마이그레이션 흐름까지를 한 자리에서 조망하는 허브 페이지다.
세대별 계보: GPT-3.5에서 GPT-5.6까지
OpenAI 모델의 역사는 크게 다섯 세대로 구분할 수 있다. ChatGPT Models Guide 2026
1세대 — GPT-3.5 Turbo (2022~2026): GPT-3.5 Turbo는 2022년 11월 30일 ChatGPT 무료 리서치 프리뷰를 구동하며 생성형 AI를 대중에게 처음 선보였다. 출시 두 달 만에 1억 명의 사용자를 확보한 이 모델은 텍스트 전용에 최대 16,385 토큰 컨텍스트 창을 가졌으며, 2023년 3월 API 공개 당시 1K 토큰당 $0.002라는 파격적인 가격으로 수많은 AI 애플리케이션의 기반이 되었다. 그러나 2026년 10월 23일 API 서비스가 완전 종료될 예정이다. GPT-3.5 Shutdown 2026
2세대 — GPT-4 / GPT-4 Turbo (2023~2024): 2023년 3월 출시된 GPT-4는 멀티모달 입력과 향상된 추론 능력을 도입했고, 같은 해 11월의 GPT-4 Turbo는 128K 컨텍스트와 비용 절감을 동시에 달성했다. 이 계열은 GPT-4 / GPT-4o 계열 페이지에 상세히 정리되어 있으며, 현재는 단계적 폐지 과정에 있다. ChatGPT Models Guide 2026
3세대 — GPT-4o / GPT-4o mini (2024): GPT-4o (옴니) 모델은 2024년 5월 출시되어 텍스트·오디오·이미지를 단일 아키텍처에서 처리하는 진정한 멀티모달 모델로 자리잡았다. GPT-4 대비 2배 빠르고 50% 저렴하며, 평균 320ms의 오디오 응답 시간을 달성했다. GPT-4o mini는 2024년 7월 출시되어 GPT-3.5보다 저렴하면서도 128K 컨텍스트와 멀티모달 능력을 갖춘 경량 모델로, ChatGPT의 기본 소형 모델 자리를 대체했다. ChatGPT Models Guide 2026
4세대 — o-시리즈 추론 모델 (2024~2025): o-시리즈 추론 모델 (o1·o3)은 체인-오브-쏘트(chain-of-thought) 내부 추론 패러다임을 도입하며 기존 GPT 계열과 근본적으로 다른 접근법을 취했다. OpenAI o 시리즈 (추론 모델) 중 o3는 ARC-AGI 벤치마크에서 고연산 조건 기준 87.5%를 달성하며 수학·과학·코딩 분야에서 강점을 보인다. 추론 모델: o1, o3, o4-mini 페이지에서 o1·o3·o4-mini의 사양·성능·가격·사용 권장 시나리오를 확인할 수 있다. ChatGPT Models Guide 2026
5세대 — GPT-5 시리즈 (2025~현재): GPT-5 시리즈 (5.0~5.5)는 GPT 계열과 o-시리즈 추론 능력을 단일 아키텍처로 통합하고, 256K 이상의 컨텍스트와 네이티브 에이전트 지원을 제공하는 최신 플래그십 패밀리다. GPT-5 모델을 기반으로 GPT-5.1, GPT-5.2, GPT-5.3 Codex, GPT-5.4, GPT-5.4 Pro, GPT-5.5, GPT-5.5 Pro 등 다양한 변형이 존재하며, 버전별 계보·가격·벤치마크 성능·지원 중단 일정은 GPT-5 시리즈 (5.0~5.5) 페이지에 상세히 정리되어 있다. 2026년 6월 기준 최신 파트너 프리뷰인 GPT-5.6 (Sol / Terra / Luna) — 최신 미리보기가 Sol·Terra·Luna 세 가지 변형으로 제한 공개 중이다. conversation
2026년 성능 순위: BenchLM 리더보드
BenchLM은 AI 언어 모델을 지식·추론·수학·다국어·멀티모달 등 다양한 카테고리를 종합한 가중 점수로 평가하는 리더보드 플랫폼이다. OpenAI 모델 순위 (2026년)에 따르면, 2026년 6월 29일 기준 총 25개 OpenAI 모델이 등재되어 있으며 최상위는 잠정 점수 90점의 GPT-5.4 Pro다. BenchLM Best OpenAI Models 2026
단, BenchLM의 순위는 BenchLM 잠정(Provisional) 점수 체계를 기반으로 하므로, 엄격한 출처 검증을 거친 공식 리더보드와 차이가 있을 수 있다는 점을 유념해야 한다.
전체 순위에서 두드러지는 패턴은 세 가지다. 첫째, GPT-5 시리즈 모델들이 상위 11개 자리를 독점하며 GPT-4 계열과 큰 점수 격차를 보인다. 둘째, OpenAI Codex 모델 계열(GPT-5.3 Codex 85점, GPT-5.2-Codex 76점, GPT-5.1-Codex-Max 75점)이 코딩 특화 모델임에도 범용 고점수를 기록한다. 셋째, OpenAI 오픈웨이트 모델인 GPT-OSS 120B(34점)와 GPT-OSS 20B(16점)는 클로즈드 모델 대비 성능 격차가 뚜렷하다. 클로즈드 모델 vs 오픈웨이트 모델 비교 페이지에서 이 차이를 더 자세히 살펴볼 수 있다. BenchLM Best OpenAI Models 2026
상위 3개 모델인 GPT-5.4 Pro(90점), GPT-5.5(88점), GPT-5.4(87점)는 불과 3점 차이로 박빙이며, 어느 모델이든 대부분의 고성능 사용 사례에서 충분하다고 평가된다. BenchLM Best OpenAI Models 2026 페이지에서 25개 전체 모델의 상세 데이터를 확인할 수 있다. BenchLM Best OpenAI Models 2026
API 가격 구조와 처리 티어
OpenAI API의 가격 체계를 이해하려면 모델별 토큰 단가와 처리 티어라는 두 축을 함께 파악해야 한다. OpenAI API Pricing 2026에 따르면 모든 가격은 토큰 100만 개(1M tokens)당 USD로 표시된다. OpenAI API Pricing 2026
처리 티어: Standard / Batch / Flex / Priority
OpenAI API 처리 티어 (Standard / Batch / Flex / Priority)는 동일 모델에 대해 속도·비용·가용성을 다르게 조합한 네 가지 옵션을 제공한다.
| 티어 | 특징 | 요금 수준 |
|---|---|---|
| Standard | 즉시 처리, 광범위 모델 지원 | 기본 요금 (1×) |
| Batch | 비실시간 대량 처리 | ~50% 할인 |
| Flex | Batch와 동일 요금, 유연한 처리 | ~50% 할인 |
| Priority | 빠른 응답 필요 시 우선 처리 | ~2.5× 프리미엄 |
예를 들어 gpt-5.4 기준으로 Standard 입력 단가는 $2.50/1M이지만, Batch 또는 Flex로 전환하면 $1.25/1M으로 절반이 된다. Priority는 $5.00/1M으로 두 배 이상 오른다. OpenAI API Pricing 2026
Priority 티어는 gpt-5.5, gpt-5.4, gpt-5.4-mini, gpt-5.3-codex 등 일부 모델에만 지원되며, 롱 컨텍스트 옵션은 Priority에서 제공되지 않는다. 또한 2026년 3월 5일 이후 출시된 모델의 지역 데이터 처리(data residency) 엔드포인트에는 10% 추가 요금이 부과된다. OpenAI API Pricing 2026
주요 모델별 가격 비교
GPT 모델 API 가격 비교 페이지에서 GPT-3.5부터 GPT-5까지 전 모델의 입출력 토큰 가격을 한눈에 비교할 수 있다. 아래는 대표 모델들의 Standard 티어 기준 요약이다. OpenAI API Pricing 2026
| 모델 | 입력 (1M tokens) | 출력 (1M tokens) | 비고 |
|---|---|---|---|
| GPT-3.5 Turbo | $0.50 | $1.50 | 2026.10 종료 예정 |
| GPT-4o mini | $0.15 | $0.60 | 저비용 멀티모달 |
| GPT-4o | $2.50 | $10.00 | 멀티모달 표준 |
| gpt-5.4-nano | $0.20 | $1.25 | 최저가 GPT-5 계열 |
| gpt-5.4-mini | $0.75 | $4.50 | 경량 플래그십 |
| gpt-5.4 | $2.50 | $15.00 | 주력 플래그십 |
| gpt-5.5 | $5.00 | $30.00 | 최신 플래그십 |
| gpt-5.4-pro / gpt-5.5-pro | $30.00 | $180.00 | 최고급 프로 |
플래그십 이외에도 OpenAI 실시간·오디오 모델 가격표, OpenAI 이미지 생성 모델 가격표 (gpt-image 계열), OpenAI 비디오 생성 모델 가격표 (Sora 계열), OpenAI 특수 모델 가격표 (Codex·Deep Research·Computer Use 등), OpenAI API 도구 및 부가 서비스 요금, OpenAI 파인튜닝 플랫폼 요금 및 종료 계획 등 각 카테고리별 상세 가격 페이지가 마련되어 있다. OpenAI API 전체 모델 가격 비교와 OpenAI 플래그십 모델 가격표 (gpt-5 계열)에서도 처리 티어별 종합 비교를 확인할 수 있다. OpenAI API Pricing 2026
지원 중단과 셧다운 타임라인
OpenAI는 모델·플랫폼의 생애주기를 체계적으로 관리하며, OpenAI API 지원 중단 정책에 따라 일반 출시(GA) 모델은 최소 6개월, GA 모델의 특수 변형은 최소 3개월, 프리뷰 모델은 최소 2주의 사전 공지를 제공한다. 주요 용어로는 Deprecated(즉시 해당 상태가 되며 이후 셧다운 날짜에 접근 불가), Sunset/Shut down(더 이상 접근 불가), Legacy(업데이트 없이 향후 폐지 예정)가 있다. OpenAI Deprecations API
OpenAI 모델 셧다운 타임라인 (2026~2027)에서 전체 일정을 한눈에 볼 수 있으며, OpenAI 레거시 모델 지원 중단 이력에서는 2022년부터 현재까지의 완전한 이력을 확인할 수 있다. 아래는 2026~2027년 주요 셧다운 일정이다. OpenAI Deprecations API
- 2026-07-23레거시 GPT 스냅샷 다수 셧다운 (gpt-5-chat-latest, gpt-5-codex, o3-deep-research 등)OpenAI Deprecations API
- 2026-08-26Assistants API 셧다운 → Responses API / Conversations API로 전환OpenAI Deprecations API
- 2026-09-24Videos API 및 Sora 2 모델 전체 셧다운OpenAI Deprecations API
- 2026-09-28gpt-3.5-turbo-instruct API 종료OpenAI Deprecations API
- 2026-10-23gpt-3.5-turbo, gpt-4, o1, o3-mini, o4-mini 등 대규모 모델 셧다운OpenAI Deprecations API
- 2026-11-30Evals 플랫폼 및 Agent Builder 셧다운, v1/prompts API 셧다운OpenAI Deprecations API
- 2026-12-11gpt-5-2025-08-07, o3-2025-04-16, o3-pro-2025-06-10 등 셧다운OpenAI Deprecations API
- 2027-01-06셀프서브 파인튜닝: 신규 작업 생성 불가OpenAI Deprecations API
2026년 가장 즉각적인 영향을 미치는 세 가지 지원 중단 사항은 다음과 같다.
GPT-3.5 Turbo 종료 (2026.10.23): GPT-3.5 Turbo를 사용 중인 개발자는 코드베이스에서 모델 문자열을 탐색하고 GPT-4o mini 또는 GPT-5 mini/nano로 교체해야 한다. Chat Completions API 요청 구조 자체는 변경되지 않아 대부분의 마이그레이션은 모델 문자열 교체로 완료된다. 파인튜닝된 GPT-3.5 모델은 베이스 모델과 함께 종료되므로 현재 베이스 모델로 재훈련이 필요하다. OpenAI 모델 마이그레이션 가이드와 GPT-3.5 Turbo vs GPT-4o mini 비교 페이지가 마이그레이션을 안내한다. GPT-3.5 Shutdown 2026
Assistants API 종료 (2026.08.26): Assistants API 지원 중단 및 마이그레이션에 따르면 Assistants API는 Responses API vs Assistants API 비교 페이지에 정리된 Responses API 및 Conversations API로 전환해야 한다. OpenAI Deprecations API
Evals·Agent Builder 종료 (2026.11.30): Evals 플랫폼 지원 중단 및 Promptfoo 마이그레이션에서 Promptfoo로의 이전 경로를, Agent Builder 지원 중단 및 Agents SDK 마이그레이션에서 Agents SDK 또는 ChatGPT Workspace Agents로의 마이그레이션을 안내한다. OpenAI Deprecations API
파인튜닝 관련해서는 OpenAI 셀프서브 파인튜닝 지원 중단에서 2027년 1월 6일 이후 신규 파인튜닝 작업 생성이 불가해지는 일정을 확인할 수 있다. Sora 계열 비디오 생성 모델은 Sora 2 및 Videos API 지원 중단 페이지에서 2026년 9월 24일 셧다운 일정을 확인하라. OpenAI Deprecations API
용도별 모델 선택
성능·비용·지원 상태를 종합하면 2026년 현재 권장 모델 선택 방향은 다음과 같이 요약된다. ChatGPT Models Guide 2026
| 사용 사례 | 권장 모델 | 근거 |
|---|---|---|
| 일상 대화·요약·글쓰기 | GPT-4o mini 또는 gpt-5.4-mini | 저비용, 빠른 속도, 멀티모달 |
| 복잡한 추론·수학·과학 | o3 또는 GPT-5.4 Pro | 높은 추론 벤치마크 |
| 코딩·소프트웨어 개발 | GPT-5.3 Codex 또는 GPT-5.2-Codex | Codex 계열 최고 점수 |
| 에이전트 워크플로 | GPT-5.5 또는 GPT-5.4 | 긴 컨텍스트, 네이티브 에이전트 지원 |
| 이미지·오디오 멀티모달 | GPT-4o 또는 gpt-image-2 | 옴니 아키텍처 |
| 예산 최소화 | gpt-5.4-nano ($0.20/1M 입력) | 최저가 GPT-5 계열 |
| 오픈웨이트 필요 | GPT-OSS 120B | 유일한 공개 가중치 대형 모델 |
사용 사례별 GPT 모델 선택 가이드와 용도별 OpenAI 모델 선택 가이드 (2026년)에서 더 세밀한 선택 기준을 확인할 수 있다. 더 넓은 시야로 타사 모델과 비교하려면 2026년 AI 모델 생태계 비교 (OpenAI·Anthropic·Google·Meta)를 참고하라. ChatGPT Models Guide 2026
에이전트 방식의 복잡한 워크플로를 구성하려는 경우 에이전트 워크플로와 다중 모델 협업 페이지가 역할 분담형 다중 모델 협업의 원리와 실무 적용 방법을 설명한다.
이 노트북의 구성
이 노트북은 아래와 같이 테마별로 조직되어 있다. 관심 영역에 따라 해당 페이지로 바로 이동할 수 있다.
모델 세대 및 사양
- OpenAI GPT 모델 세대별 진화 — GPT-3.5부터 GPT-5까지 전 세대 비교
- GPT-5 시리즈 (5.0~5.5) — 버전별 계보, 가격, 벤치마크 성능, 용도별 선택 가이드 및 지원 중단 일정
- GPT-5 모델 — GPT-5 단일 모델 상세
- GPT-4 / GPT-4o 계열 — GPT-4 Turbo, GPT-4o(Omni), GPT-4o-mini의 사양·가격·성능 비교 및 사용 권장 가이드
- GPT-4o (옴니) 모델 — 멀티모달 옴니 아키텍처 상세
- GPT-4o mini — 경량 멀티모달 모델
- GPT-3.5 Turbo / GPT-3.5 Turbo — 레거시 모델 (2026년 10월 23일 중단 예정)
- o-시리즈 추론 모델 (o1·o3) / OpenAI o 시리즈 (추론 모델) / 추론 모델: o1, o3, o4-mini — 체인-오브-쏘트 추론 모델
- OpenAI Codex 모델 — 코딩 특화 모델
- OpenAI 오픈웨이트 모델 — GPT-OSS 120B·20B
- 클로즈드 모델 vs 오픈웨이트 모델 (OpenAI, 2026년) — 비교
- 전체 모델 성능 & 가격 비교표 — 전체 모델 가격·성능·특징·지원 상태 종합 비교 및 마이그레이션 로드맵
성능 순위 및 벤치마크
- BenchLM — 리더보드 플랫폼 소개
- BenchLM Best OpenAI Models 2026 — 25개 모델 순위 데이터
- OpenAI 모델 순위 (2026년) — 순위 분석
- BenchLM 잠정(Provisional) 점수 체계 — 점수 산정 방식
가격 및 처리 티어
- OpenAI API 처리 티어 (Standard / Batch / Flex / Priority) — 티어 개념
- OpenAI API Pricing 2026 — 공식 가격표 출처
- GPT 모델 API 가격 비교 — 모델별 가격 비교
- OpenAI API 전체 모델 가격 비교 — 카테고리별 종합 비교
- OpenAI 플래그십 모델 가격표 (gpt-5 계열)
- OpenAI 실시간·오디오 모델 가격표
- OpenAI 이미지 생성 모델 가격표 (gpt-image 계열)
- OpenAI 비디오 생성 모델 가격표 (Sora 계열)
- OpenAI 특수 모델 가격표 (Codex·Deep Research·Computer Use 등)
- OpenAI API 도구 및 부가 서비스 요금
- OpenAI 파인튜닝 플랫폼 요금 및 종료 계획
지원 중단 및 마이그레이션
- OpenAI API 지원 중단 정책 — 정책 및 용어
- OpenAI Deprecations API — 공식 중단 일정
- OpenAI 모델 셧다운 타임라인 (2026~2027) — 전체 일정표
- OpenAI 레거시 모델 지원 중단 이력 — 과거 이력
- GPT-3.5 Shutdown 2026 — GPT-3.5 종료 안내
- OpenAI 모델 마이그레이션 가이드 — 마이그레이션 절차
- GPT-3.5 Turbo vs GPT-4o mini 비교 — 대체 모델 비교
- Assistants API 지원 중단 및 마이그레이션
- Responses API vs Assistants API 비교
- Evals 플랫폼 지원 중단 및 Promptfoo 마이그레이션
- Agent Builder 지원 중단 및 Agents SDK 마이그레이션
- Sora 2 및 Videos API 지원 중단
- OpenAI 셀프서브 파인튜닝 지원 중단
선택 가이드 및 비교
- 사용 사례별 GPT 모델 선택 가이드
- 용도별 OpenAI 모델 선택 가이드 (2026년)
- 에이전트 워크플로와 다중 모델 협업
- 2026년 AI 모델 생태계 비교 (OpenAI·Anthropic·Google·Meta)
- OpenAI 모델들 — GPT-3.5부터 GPT-5.6까지 전체 모델의 특징·가격·성능·지원 상태 정리
- ChatGPT Models Guide 2026
- 빠른 참조 & 선택 가이드 — 용도·가격·속도·타임라인 기준 5초 모델 선택 가이드