적어도 o4까지는 4o 기반인거 확정인데
그럼 아주 극단적인 작은 확률로 내뱉는 4o 답변의 최고점이 o4 급이라는 소리임?
o4부터는 오리온이라고 디인포가 그랬던거 같은데
그럼 o4는 4.5가 베이스모델임?
몰라
오피셜로 나오기전까진 모르는거임
그래서 4.5도 굳이 베이스모델로 낸 거 같은데... 추후에 추론모델이랑 짬뽕해서 GPT-5에 써먹어야하니깐... 근데 최적화를 잘 못해서 이꼴난듯
근데 그거 반박하는 논문 나왔지 않나 뭐 비추론모델로 1000번 돌려도 0점이던거 추론모델로 97점 받았다는
이 프로세스에 대해 생각하는 한 가지 방법은 GPT-3가 이미 가지고 있었지만 신속한 엔지니어링만으로 이끌어내기 어려웠던 기능을 '잠금 해제'한다는 것입니다."라고 말했습니다.https://www.ibm.com/think/topics/rlhf이거?
그거 맞는듯
o4부터는 오리온이라고 디인포가 그랬던거 같은데
그럼 o4는 4.5가 베이스모델임?
몰라
오피셜로 나오기전까진 모르는거임
그래서 4.5도 굳이 베이스모델로 낸 거 같은데... 추후에 추론모델이랑 짬뽕해서 GPT-5에 써먹어야하니깐... 근데 최적화를 잘 못해서 이꼴난듯
근데 그거 반박하는 논문 나왔지 않나 뭐 비추론모델로 1000번 돌려도 0점이던거 추론모델로 97점 받았다는
이 프로세스에 대해 생각하는 한 가지 방법은 GPT-3가 이미 가지고 있었지만 신속한 엔지니어링만으로 이끌어내기 어려웠던 기능을 '잠금 해제'한다는 것입니다."라고 말했습니다.
https://www.ibm.com/think/topics/rlhf
이거?
그거 맞는듯