그게 제일 중요하긴 하겠지
님들 생각은 어떰
TTC 돌리고 들이붓고 재학습시키고 TTC 돌리고 들이붓고 재학습시키고
무한반복하면 COT 데이터셋 이 엄청나게 비대해질거고 추론밀도도 엄청나게 두꺼워 질텐데
계속하면? 뭐가나올거같음
그게 제일 중요하긴 하겠지
님들 생각은 어떰
TTC 돌리고 들이붓고 재학습시키고 TTC 돌리고 들이붓고 재학습시키고
무한반복하면 COT 데이터셋 이 엄청나게 비대해질거고 추론밀도도 엄청나게 두꺼워 질텐데
계속하면? 뭐가나올거같음
일리야도 추론 스케일링 한계 얘기는 안한거보면 ㄹㅇ 이걸로 다 깨부술듯
그런데 결론적으로 저 인간감독하 재학습루프를 무한반복하면 최종적으로? 뭐가나올거냐는거지 그게 제일 궁금함 지금 gemini 3.0 iq 수열벤치상 185 ++ 임
추론 스케일을 늘리면 모델가격이 ㅈㄴ비싸지지
이미 지금도 모델 아이큐 자체는 ㅈㄴ ㅈㄴ 높을텐데 뭔가 뚜렷한 돌파구가 나온건 아니라
이미 인간계 iq test 벤치로는 측정못한다더라
기가소사이어티 문제들은 아직 못깻긴했는데 이것도 결국은 곧이라
과추론 같은 문제도 생기긴 해서 단순하지만은 않을거 같음 그런 문제들을 쳐나가면서 추론 스케일링을 해나가야겠지
그리고 모델을 좀 더 에이전틱하게 만드는 것도 중요할 듯
그래서 몇 시간 며칠 몇 주 몇 년 수십년 이상 생각해서 문제를 푸는 ai를 상상해보라 oai 연구원이 말한거지. 최후의 질문은 과연 몇 년이 소요될까?