젬3은 성능향상에 집중했다 쳐도, 젬3.5에서도 그대로면 구글은 자기들 모델의 문제가 뭔지 모른다는거일 듯? 나중에 그걸로 발목 잡혀서 다른 회사에 기회를 더 줄지도 모르겠다는 생각이 들었음
단점과 문제가 뭔데?
일반적인거라 그러면 고집피우면서 드러눕는거랑 도구 쥐어줬을때 폼 안 나오는거
환각 치매 고집
@ㅇㅇ 도구 사용은 계속 의식하는거 같긴 하던데 진짜 공홈 시스템 프롬프트좀 갈아엎긴 해야함. 고집은 사실 난 요즘은 추론 모델 기준 gpt나 gemini나 비슷해진거 같음 ㅋㅋ
그리고 2.5 3월 공개~6월 정출가면서 아첨 팍 늘어났는데, 3도 그거 그대로 가져갔음
@ㅇㅇ 아첨은 사실 사용자 선호도와 지표는 좋아지니까 걍 문제 알면서도 놔두는 느낌임 어차피 언론에서는 gpt가 대신 맞아주니
@ㅇㅇ1(14.38) 공홈 시스템 프롬프트 개구린 것도 한몫하지만, AIS에서 이래저래 프롬프트 짜봐도 크게 나아지지 않는거 보면 모델 특성이 더 크게 차지하는 듯
@ㅇㅇ1(14.38) 근데 그렇게 1위 따봤자 결국 4o 사건의 반복만 일어날텐데 말이야
@ㅇㅇ 어쩔 수 없이 상대적으로 보수적으로 바뀐 gpt 점유율 갉아먹은 다음에 수정하겠다는 전략이겠지 ㅋㅋ
아는데 안하는거지
못 고친다고 문제를 모르는 건 아님
젬3에서는 네 말이 맞을텐데 3.5에서도?