uncertainty routed가 정확히 뭔기술인진 모르겠는데 gpt4엔 이걸 적용하지않고 제미니에만 적용했더니 90%찍었다는 비교가 유효한 비교인가싶네뭔가 api만으로는 못하는 내부 소스를 건드려야만 하는 기술인거 같은데 gpt4는 그걸 안한채로 직접적인 비교해서 자기가 우월하다는 결론은 뭔가 이상함
약간 기울어진 운동장 그런느낌 아닐까
정확한 비교가 되려면 gpt4에도 저걸 적용하던가, 아니면 첫번째랑 두번째 그래프대로 그냥 제미니가 성능 낮다는 결론이 공정한 결론인듯
일반적인 지수인 cot는 한참 따,이는데 이상한거 들이밀어서 평균 비슷하다고 퉁쳐버림
너 그림 말고 텍스트 읽어본거 맞냐? gpt4에서도 적용했는데 그냥 cot 한거랑 차이 없는 수준이었다고 써있는데 - dc App
모델이 일관적으로 좋은 답을 할 때보다 어쩔땐 아주 좋은 대답하고 어쩔 땐 대충 대답하고 이럴 때 적용하면 좋아질지도 모른다는 가정으로 해봤더니 이렇더라라는 내용이라서 - dc App
ㄹㅇ? 신기하네