ai·AI 큐레이션
OpenAI, 새로운 멀티모달 모델 GPT-5 발표
OpenAI가 텍스트·이미지·오디오를 통합 처리하는 GPT-5를 공개했습니다. 추론 능력과 컨텍스트 윈도우가 대폭 개선되었습니다.
요약
OpenAI가 최신 멀티모달 대형 언어 모델 GPT-5를 공개했습니다. 이번 모델은 텍스트, 이미지, 오디오를 단일 컨텍스트에서 처리하며, 추론 능력이 이전 세대 대비 크게 향상되었다고 합니다.
주요 변경점
- 통합 멀티모달: 별도 비전·오디오 모델 없이 하나의 모델로 처리
- 컨텍스트 윈도우 확장: 입력 토큰 한도가 128K에서 1M로 증가
- 추론 모드 강화: 단계별 사고(chain-of-thought) 최적화로 수학·코딩 벤치마크에서 15~30% 향상
큐레이터 코멘트
GPT-5의 가장 큰 의미는 모달리티 통합보다 추론 능력의 도약에 있습니다. 벤치마크 수치는 인상적이지만, 실제 운용 환경에서의 지연시간·비용 균형이 관건일 것입니다. 경쟁사 Anthropic·Google의 대응이 주목됩니다.
본문은 원문을 요약·큐레이션한 것이며, 전체 내용은 원문에서 확인할 수 있습니다.