OpenAI GPT 모델 세대별 진화
OpenAI는 2022년 ChatGPT 출시 이후 빠른 속도로 모델 패밀리를 확장해 왔다. 이 페이지는 ChatGPT Models Guide 2026을 바탕으로 GPT-3.5부터 GPT-5, 그리고 o-시리즈 추론 모델 (o1·o3)까지 각 세대의 핵심 특성을 비교·정리한다. OpenAI 모델 개요와 2026년 AI 모델 생태계 비교도 함께 참고하면 좋다. ChatGPT Models Guide 2026
전체 모델 한눈에 비교
| 모델 | 출시 | 컨텍스트 | 주요 용도 | API 가격 (입력/출력, 백만 토큰당) |
|---|---|---|---|---|
| GPT-3.5 Turbo | 2022년 11월 | 16K | 기본 작업, 저비용 | $0.50 / $1.50 |
| GPT-4 | 2023년 3월 | 8K–32K | 복잡한 추론 | 레거시 |
| GPT-4 Turbo | 2023년 11월 | 128K | 장문 문서 처리 | 레거시 |
| GPT-4o | 2024년 5월 | 128K | 멀티모달, 음성 | $2.50 / $10 |
| GPT-4o mini | 2024년 7월 | 128K | 빠른 처리, 저비용 | $0.15 / $0.60 |
| o1 | 2024년 9월 | 200K | 프로덕션 추론 | $15 / $60 |
| o3 | 2024년 12월 | 200K | 고급 추론 | $20 / $80 |
| GPT-5 | 2025년 말 | 256K+ | 에이전트 워크플로 | ~$5 / $20 |
가격은 수시로 변경될 수 있다. 최신 가격은 OpenAI 공식 페이지에서 확인하고, OpenAI API Pricing 2026 및 GPT 모델 API 가격 비교도 참조하라. ChatGPT Models Guide 2026
세대별 상세 내용
GPT-3.5 — 모든 것의 시작 (2022년 11월)
OpenAI는 2015년 일론 머스크와 샘 알트만을 포함한 팀이 설립한 비영리 연구 기관이다. "Improving Language Understanding by Generative Pre-Training" 논문이 트랜스포머 아키텍처를 도입했고, 이후 GPT-1(2018), GPT-2(2019), GPT-3(2020)로 이어졌다. GPT-3를 대화형 인터페이스에 결합한 것이 ChatGPT이다. ChatGPT Models Guide 2026
ChatGPT(GPT-3.5 기반)는 출시 두 달 만에 1억 명의 사용자를 확보하며 AI를 대중화했다. ChatGPT Models Guide 2026
| 사양 | 내용 |
|---|---|
| 파라미터 수 | 1,750억 개 |
| 학습 데이터 | 웹 페이지·기사·도서 약 45TB |
| 주요 언어 | 영어 90% 이상 |
| 컨텍스트 | 4K 토큰 (GPT-3.5 Turbo에서 16K로 확대) |
| 주요 한계 | 환각 현상, 제한적 추론 |
GPT-3.5 Shutdown 2026 페이지에서 해당 모델의 서비스 종료 경위를 확인할 수 있다.
GPT-4 — 추론의 도약 (2023년 3월)
GPT-4는 2023년 3월 14일 ChatGPT Plus 구독자와 API를 통해 출시됐다. 텍스트·이미지 멀티모달 입력, 확장된 컨텍스트, 대폭 개선된 추론 능력을 갖췄다. 학습 토큰 약 13조 개, 파라미터 약 1.8조 개로 추정된다. ChatGPT Models Guide 2026
| 벤치마크 | GPT-3.5 | GPT-4 | 개선 폭 |
|---|---|---|---|
| 모의 변호사 시험 | 하위 약 10% | 상위 10% | 대폭 향상 |
| 신장내과 문제 | N/A | 73.3% 정답 | 신규 역량 |
| SAT 점수 | 약 1,200점 | 1,410/1,600점 | +210점 |
| 사실 정확도 | 기준선 | +40% | 유의미한 향상 |
ChatGPT Models Guide 2026
GPT-4는 고객 지원, 영업, 마케팅, 데이터 분석, 소프트웨어 개발 등 기업용 LLM 도입을 폭넓게 견인했다. ChatGPT Models Guide 2026
GPT-4 Turbo — 속도와 효율성 (2023년 11월)
GPT-4 Turbo는 컨텍스트 창을 128K 토큰(300페이지 이상 분량)으로 확장하고, 학습 데이터 기준일을 2023년 4월로 연장했다. 코드베이스·법률 문서·연구 논문 전체를 단일 프롬프트에서 처리하는 것이 가능해졌다. 다만 일부 벤치마크에서 GPT-4보다 표준화 시험 점수가 소폭 낮다는 비판도 있었다—속도·비용 개선을 위한 트레이드오프였다. ChatGPT Models Guide 2026
GPT-4o — 옴니 모델 (2024년 5월)
GPT-4o (옴니) 모델은 텍스트·오디오·이미지를 단일 아키텍처에서 네이티브로 처리한다. 세 가지 모달리티를 이어붙인 것이 아니라 처음부터 멀티모달 시스템으로 훈련되었다. ChatGPT Models Guide 2026
| 능력 | GPT-4 | GPT-4o |
|---|---|---|
| 속도 | 기준선 | 2배 빠름 |
| 비용 | 기준선 | 50% 저렴 |
| 오디오 | 외부 TTS/STT | 네이티브, 평균 320ms 응답 |
| 이미지 | 기본 이해 | 고급 시각 추론 |
| 컨텍스트 | 8K–32K | 128K |
음성 입력 평균 응답 시간은 320ms로, 인간의 230ms에 근접한다. ChatGPT Models Guide 2026
GPT-4o mini (2024년 7월)는 GPT-4o 대비 60% 저렴하면서도 강력한 추론 성능을 유지해 비용 민감형 애플리케이션의 기본 모델로 자리 잡았다. ChatGPT Models Guide 2026
o1 · o1-mini — 추론의 혁명 (2024년 9월)
o-시리즈 추론 모델 (o1·o3)의 첫 제품인 o1(코드명 "Strawberry")은 응답하기 전에 내부 체인 오브 소트(Chain-of-Thought) 추론을 수행한다. OpenAI의 노암 브라운은 이를 심리학의 "시스템 2 사고"—느리고 의도적인 인간 추론—에 비유했다. ChatGPT Models Guide 2026
| 벤치마크 | GPT-4o | o1 | 개선 폭 |
|---|---|---|---|
| 국제수학올림피아드(IMO) | 13% | 83% | 6.4배 |
| Codeforces (경쟁 프로그래밍) | 11 퍼센타일 | 89 퍼센타일 | 8배 |
| 박사급 과학 문제 | 69% | 78% | +9%p |
OpenAI에 따르면 o1은 물리학·생물학·화학에서 박사과정 학생 수준의 성능을 보인다. ChatGPT Models Guide 2026
o1-mini는 광범위한 세계 지식이 불필요한 STEM 과제에 최적화된 저비용 버전이다. ChatGPT Models Guide 2026
o3 — 추론의 경계를 넘다 (2024년 12월)
o3는 2024년 12월에 미리보기로 공개됐다. ARC-AGI 벤치마크에서 고컴퓨팅 모드 기준 87.5%를 달성했는데, 이전 모델들은 30%도 돌파하기 어려웠던 시험이다. ChatGPT Models Guide 2026
- 학습 데이터 범위를 넘어선 일반화 능력을 최초로 입증
- 코딩·수학·과학 추론 대폭 개선
- 인공일반지능(AGI) 경로에 대한 논의를 재점화
- 추론 모델을 독립적이고 필수적인 모델 카테고리로 정립
ChatGPT Models Guide 2026
GPT-5 — 통합 플래그십 (2025년 말)
GPT-5 모델은 GPT 라인과 o-시리즈를 단일 아키텍처로 통합한 OpenAI의 가장 야심찬 모델이다. ChatGPT Models Guide 2026
| 기능 | GPT-4o | GPT-5 |
|---|---|---|
| 컨텍스트 | 128K | 256K+ |
| 추론 | 기본 | o3 수준 통합 |
| 에이전트 작업 | 제한적 | 네이티브 에이전트 지원 |
| 멀티모달 | 텍스트·이미지·오디오 | 풀 비디오 이해 포함 |
| 속도 | 빠름 | GPT-4o 대비 2배 빠름 |
GPT-5의 가장 큰 변화는 에이전트 워크플로 지원이다. 단순 질의응답을 넘어 다단계 작업을 자율적으로 계획·실행한다. 에이전트 워크플로와 다중 모델 협업 페이지에서 더 자세히 살펴볼 수 있다. ChatGPT Models Guide 2026
모델 진화 흐름도
사용 사례별 추천 모델
사용 사례별 GPT 모델 선택 가이드에서 더 자세한 기준을 확인할 수 있다. ChatGPT Models Guide 2026
| 사용 사례 | 추천 모델 | 이유 |
|---|---|---|
| 일상 채팅, 간단한 Q&A | GPT-4o mini | 빠르고 저렴, 대부분의 작업에 충분 |
| 글쓰기, 창작 | GPT-4o 또는 GPT-5 | 품질과 속도의 최적 균형 |
| 복잡한 추론, 수학 | o1 또는 o3 | 어려운 문제에 대한 체인 오브 소트 |
| 장문 문서 (50페이지+) | GPT-5 | 256K+ 컨텍스트 |
| 음성 대화 | GPT-4o | 자연스러운 인토네이션의 네이티브 오디오 |
| 코딩·디버깅 | 복잡하면 o1, 일반이면 GPT-4o | 문제 난이도에 따라 선택 |
| 비용 절감이 중요한 앱 | GPT-4o mini | GPT-4o 대비 60%+ 저렴 |
| 에이전트 다단계 작업 | GPT-5 | 네이티브 에이전트 지원 |
ChatGPT Models Guide 2026
2026년 AI 모델 생태계
OpenAI 외에도 여러 주요 제공업체가 프런티어 모델을 출시하고 있다. 2026년 AI 모델 생태계 비교에서 전체 비교를 확인할 수 있다. ChatGPT Models Guide 2026
| 제공업체 | 플래그십 모델 | 강점 |
|---|---|---|
| OpenAI | GPT-5, o3 | 에이전트 워크플로, 추론의 폭넓은 역량 |
| Anthropic | Claude (최신) | 장문 분석, 안전성 |
| Gemini Pro (최신) | Google Workspace 연동, 멀티모달 | |
| Meta | Llama 4 | 오픈소스, 자가 호스팅 가능 |
컴퓨터 과학자 앤드류 응(Andrew Ng)은 "GPT-3.5에 에이전트 워크플로를 감싸면, 단순 프롬프팅으로 사용한 GPT-4보다 더 좋은 결과를 낸다"고 지적했다. ChatGPT Models Guide 2026
세대별 AI 발전의 의미
- 2022-11-01GPT-3.5: 대화형 AI를 일반 대중에게 공개, 2개월 만에 1억 명 달성ChatGPT Models Guide 2026
- 2023-03-14GPT-4: 멀티모달 입력과 대폭 향상된 추론으로 기업 AI 도입 가속화ChatGPT Models Guide 2026
- 2023-11-01GPT-4 Turbo: 128K 컨텍스트로 장문 문서 처리 실용화ChatGPT Models Guide 2026
- 2024-05-01GPT-4o: 텍스트·오디오·이미지를 단일 아키텍처에서 처리하는 옴니 모델 출시ChatGPT Models Guide 2026
- 2024-07-01GPT-4o mini: 60% 저렴한 비용으로 비용 민감형 앱의 기본 모델 등극ChatGPT Models Guide 2026
- 2024-09-01o1: 체인 오브 소트 내부 추론으로 수학·과학에서 획기적 성능 향상ChatGPT Models Guide 2026
- 2024-12-01o3: ARC-AGI 87.5% 달성, AGI 논의 재점화ChatGPT Models Guide 2026
- 2025-11-01GPT-5: GPT 라인과 o-시리즈를 통합, 256K+ 컨텍스트와 네이티브 에이전트 지원ChatGPT Models Guide 2026
ChatGPT Models Guide 2026
관련 페이지
- o-시리즈 추론 모델 (o1·o3) — 체인 오브 소트 추론 방식 상세 설명
- GPT-4o (옴니) 모델 — 멀티모달 단일 아키텍처 심층 분석
- GPT-5 모델 — 통합 플래그십 모델 상세
- OpenAI API Pricing 2026 — 최신 가격표
- GPT 모델 API 가격 비교 — 모델 간 비용 비교
- 사용 사례별 GPT 모델 선택 가이드 — 용도별 최적 모델 안내
- 에이전트 워크플로와 다중 모델 협업 — 다중 모델 시스템 구성 방법
- 2026년 AI 모델 생태계 비교 (OpenAI·Anthropic·Google·Meta) — 경쟁 모델 비교
- BenchLM Best OpenAI Models 2026 — 벤치마크 기반 모델 평가
- OpenAI Deprecations API — 레거시·지원 종료 모델 현황