이전 세계에서는 GPT-6까지 실현되지 않을 것이라고 예측했던 많은 벤치마크에서 성능을 달성할 수 있습니다.
훨씬 작은 모델로부터, 이 강화학습을 통해서 말입니다.
알트만 인터뷰 보면 o1인지 o3인지 모르겠지만 지금 추론 모델 수준의 벤치를 달성하려면
GPT-6 수준은 되어야 하는거임... (4.5대비 1000배)
GPT-6 수준은 되어야 하는거임... (4.5대비 1000배)
이전 세계에서는 GPT-6까지 실현되지 않을 것이라고 예측했던 많은 벤치마크에서 성능을 달성할 수 있습니다.
훨씬 작은 모델로부터, 이 강화학습을 통해서 말입니다.
맞음 ㅋㅋ 스타게이트까지 동원해도 베이스모델로는 O3급도 힘들겠네 확실하다
지금 와서 보니까 밑밥은 다 깔아놓았었음 베이스모델은 앞으로 추론 발사대로 쓰이는듯
새삼 추론시스템이 엄청나다는게 느껴지네
괜히 노암 브라운이 ASI로 가는 가장 큰 관문을 해결했다고 말한 게 아닌듯
그렇다고 추론모델만 개발하면 수학자폐아처럼 되니까ㅋ
인터뷰 뒷 내용 보면 추론 모델은 현재 특정한 부분에서만 성능향상을 보이기 때문에 사전훈련 스케일링 한다는 늬앙스로 말함
해당 댓글은 삭제되었습니다.
알트만 기준 AGI가 좀 낮긴함 작년 말에 인터뷰 한 내용에서는 아마 고도로 어려운 작업에서 훌륭한 인간만큼의 업무를 수행할 수 있는 AI를 AGI라고 생각한다고 말했던걸로 기억함