회당 80억으로 기반모델 학습(사실인지도 모름)
여기다가 강화학습+파인튜닝함(이미 o1발표때 강화학습이 정수라고 언급함)
성능 좋은거 인정
오픈소스도 부분인정(절대 다 공개한다하면서 훈련 데이터셋이랑 모델은 안깜)
뭐가 혁신이노?
회당 80억으로 기반모델 학습(사실인지도 모름)
여기다가 강화학습+파인튜닝함(이미 o1발표때 강화학습이 정수라고 언급함)
성능 좋은거 인정
오픈소스도 부분인정(절대 다 공개한다하면서 훈련 데이터셋이랑 모델은 안깜)
뭐가 혁신이노?
ㅋㅋ - dc App
그 별거아닌 거 유럽조차 못한 걸 중국이 했습니다
성능 좋은건 인정 근대 초점은 80억 어쩌규에 이성능을?이지 성능만 좋은개 중요한게 아니었잖
유럽은 애초부터 나가리지 ㅇㅇ...
데이터셋은 공개하면 소송당할듯 ㅋㅋ
웹추론이 혁신임 지금 딥시크 빼고 보여준곳 없음
싸게
안 싸서문제
저수준 언어까지 써가면서 효율을 뽑아낸거라 메타도 못따라하는 추론검색을 해내긴했어요. 복붙이 문제지만
추론검색은 엄청난 혁신까진 아니지만 인정
o1이 한건 강화학습 비스무리한 다른거고(결국에 위에서 봤을때 강화학습) r1은 독자적인거 같긴함
r1 zero가 강화학습이고 이걸론 찐빠나서 튜닝한게 r1임
즉 o1과 메커니즘상 다른게없음
별거없는거면 좀 진작에 내놓지 그랬노