### 성능 비교 (가중 평균)
- **GPT-4o**: 78.1%
- **GPT-4T**: 73.4%
- **Claude Opus**: 62.8%
- **Gemini 1.5 Pro**: 66.6%
### 차이 계산
- **GPT-4o vs. GPT-4T**: 4.7% 더 뛰어남
- **GPT-4o vs. Claude Opus**: 15.3% 더 뛰어남
- **GPT-4o vs. Gemini 1.5 Pro**: 11.5% 더 뛰어남
### 결론
가중치를 감안한 결과, GPT-4o는 GPT-4T, Claude Opus, Gemini 1.5 Pro보다 각각 4.7%, 15.3%, 11.5% 더 뛰어납니다. (근거: 각 모델의 벤치마크 점수 평균)
이렇다고 함 ㅇㅇ
Gpt4o랑 gpt4 turbo MMLU에서 2% 차이 밖에 없지만 더 어려운 MMLU-Pro벤치에서 9% 차이난다 함 이제 MMLU는 벤치 기능을 잃음
생각보다 그렇게 큰차이 없네? 클로드랑 gpt4터보랑
성능은 더 증가했는데 존나 가벼워지고 저렴해지고 멀티모달이라는 게 핵심임 - dc App - dc App
ㄹㅇ
미쳣네 압살 ㄷㄷ
아무리 봐도 클로드보다 잼미니가 더 좋다는게 말이 안됨
이건 ㄹㅇ 아닌데 ㅋㅋ
잼미니 클로드 비교만 봐도 이상한데 잼미니 아래로 처박아야지 - dc App