당장 소넷하고 4o arc 점수만 해도 꽤 차이가 많이 남 


라이브 벤치에서 gemini 2.0하고 4o 점수도 꽤 차이가 있고 얘네들은 사전학습모델임 


그런데 한계까지는 아니지만 사전 학습 모델로 더이상 gpt3>>gpt4로 넘어간거처럼 


gpt5를 만들기엔 이젠 o1 ,o3 같은 강화학습 모델이 필요해진거라고 봐야 할듯