난 3.5 소넷 나온 이후로 항상 메인으로 쓰고있고
o1, o3-mini, 딥시크 나온 이후로도 항상 3.5 소넷을 씀.
뭐 더 심오한 문제라던가 그런건 추론특화 모델이 나은 경우도 있지만
일반적 질문이나 코딩 이런건 아직도 3.5 소넷이 쓰기 제일 좋음.
그거에 대한 반증이 오픈라우터 사용량 랭킹이 아닌가 싶은데
나는 모델 교차검증 이런거 좋아해서 위 스크린샷처럼
3개 모델 동시에 띄워놓고 동일질문함.
매일 이렇게 쓰는데 거의 항상 소넷 답변이 가장 좋음.
지난번 소넷 성능저하 논란있었을 즈음부터 아웃풋 토큰 줄여놔서 답 존나 짧게하는 건 짜치는데 그래도 가장 뛰어남.
항상 짧게 대답하는 건 아니고 필요한 경우에만 좀 길게 답해주는 편임.
근데 이게 무려 작년 6월에 나온건데... 대신 쓸만한게 아직도 읎냐... 딥시크는 CoT 느려서 뭐 일상적으로 써먹기 어렵던데.
챗GPT 원툴만 구독해서 챗GPT가 젤 조앙 하는 애들은 니 말이 맞음.
ㄹㅇ제미니 2.0이니 o3 mini니 시끄러워도 아직도 소넷3.5가 제일 국밥이더라 - dc App
베이스모델 SOTA 인정하는데 제발 기반으로 추론모델좀 내줘
베이스 모델 보다는 추론에 집중시키는 것 같긴함. 말빨좋은게 과학에 도움이 되는건 아니니까