지금 올구독 중인데, 그록 꽤 좋음. 처음에는 문맥 못알아먹고 이상한 소리해서 별로였는데, 지금은 오히려 다른 모델보다 instruction following 잘 할 때도 많음. 모든 모델 대충 정리하자면


O3: 다들 잘 알테니 생략함. 한국어 이상하게 씀. 영어로 쓰면 가독성 좀 ㄱㅊ. 토큰 아웃풋 걸려서 세부사항 누락할 때 많음.


그록4: 서치 열심히 함. O3보다 연구적 부분 실사용에서는 구독료만큼 좋은 느낌은 못 받음. 다만 아웃풋은 길게 잘 뽑아줘서 사용감 나쁘지 않음.


Gemini: 세부사항, 디테일 잘 체크함. 근데 새로운 아이디어 방향을 제시하는건 o3보단 별로임. o3으로 물어보고 제미니로 디테일 잡는게 좋음.


Cluade 모델들: 코딩 GOAT



O3 Pro: O3 고점을 계속 보는 느낌. 최근에 생각하는 시간 줄면서 성능 이상해짐. GPT5는 아직 못받아서 모름


그록 헤비: 대수 패키지, 서치 등 툴 적극 활용함. O3 Pro보다 추론 짧게 하고 나은 답을 제공할 때가 많았음. 추론시간 짧은데 퀄이 나오는게 실사용에서 크게 좋음. 아웃풋 토큰도 꽤 길게 뽑아줌. 헤비도 처음 출시땐 단답으로 대답하고 이상했는데 지금은 좋음.


Gemini DeepThink: 좋은데 공홈 + 추론시간이 너무 길고 한도가 문제임. 깡계 파면 된다지만 이전 채팅 마크다운으로 내보내기 해서 먹이고 지시사항 줘도 문맥 못알아먹을때가 있음. 공홈이 쓰레기인게 실사용에서 치명적임. 



만약 그록 헤비가 250달러였으면 그록 계속 구독했을듯. 근데 너무 비싸서 GPT Pro 계속 구독할 예정이긴 함.