앤트로픽을 위한 변명을 하자면 o1은 추론 특화모델이고 sonnet은 범용 모델이라 그렇겠지만공식 영상에서 Hello sam 보여주면서 oai 돌려서 맥이던 그 앤트로픽 치고는 좀 짜치긴 하다...
별걸로 다 억까를 하노 3.5 소넷은 4o랑 비교해야지
4o가 범용이니까 이쪽이랑 비교하는게 맞긴해
지금 ai업계가 고점뚫기대결인데 미들라인 가성비 운운딸쳐봐야 ㅈ도 의미없음 이거 구글이 자주 플래쉬로 했던건데 애들 반응이나 있냐
ㄴ 그래서 o1 프리뷰 뭐할때 씀? 멀티모달도 없는데 쓰긴 함?
난 자주쓰는데? 일상적인 질문해도 추론능력이 완전다른데
담에는 또 모르지 혁신 나와서 알트만 똥꼬 힘들어가게 될지
해당 댓글은 삭제되었습니다.
본문 내용처럼 사소한것에도 기싸움하던 앤트로픽이 o1도 벤치마크에 같이 적을줄 알았는데 뺄줄은 몰랐다는거임 앤트로픽도 잘했음 범용 모델인데도 코딩 부분은 아주 의미가 있다고 생각함
지금 소넷이 o1 preview나 mini보다 코딩은 한단계 위가 맞는 듯 SWE-Bench Verified 점수로 봐도 그렇고 오늘도 o1들이 못풀던거 클로드가 이상하게 다 해결해주더라니 잠수함 버프였네