이전 세계에서는 GPT-6까지 실현되지 않을 것이라고 예측했던 많은 벤치마크에서 성능을 달성할 수 있습니다.

훨씬 작은 모델로부터, 이 강화학습을 통해서 말입니다.


알트만 인터뷰 보면 o1인지 o3인지 모르겠지만 지금 추론 모델 수준의 벤치를 달성하려면
GPT-6 수준은 되어야 하는거임... (4.5대비 1000배)