1. GPT 4.5 → 음성 + 텍스트 + 이미지 비전 을 결합한 멀티모달 신경망 (사만다) : 6~7월 주중 배포 예정 (이미 개발완료, 곧 배포)


2. GPT 5 → [음성 + 텍스트 + 이미지 입출력] + [비디오 비전] 을 결합한 멀티모달 단일 신경망 , 고품질 미세조정을 위한 모라 , 장기기억을 위한 KV선형 덧셈 인피니 어텐션 (컨텍스트 캐싱) : 11월 ~ 2025 년 초 배포 예정 (이미 개발완료 , 보급상용화를 위한 네트워크 인프라 및 하드웨어 구축중)


3. GPT 6 → Next Frontier 모델 [음성 + 텍스트 + 이미지 + 비디오 입출력] 단일 신경망 에서 모든 데이터 입출력 가능 , 고품질 미세조정을 위한 모라 , 수백만 단위의 컨텍스트 토큰 : 출시일 미1정  , 현재 학습 진행중