| o1-mini-2024-09-12 | OpenAI | 57.38 | 72.33 | 48.05 | 60.89 | 56.73 | 40.89 | 65.40 |
| o1-preview-2024-09-12 | OpenAI | 65.63 | 67.42 | 50.85 | 64.92 | 67.31 | 68.72 | 74.60 |
| gemini-2.0-flash-exp | 57.99 | 59.08 | 54.36 | 59.39 | 59.68 | 33.55 | 81.86 | |
| qwq-32b-preview | Alibaba | 39.85 | 57.71 | 37.20 | 55.88 | 31.62 | 21.09 | 35.59 |
57.99 종합점수
1206 보다는 못하지만 지금까지 구글 모델 중 2번째로 높은 점수에 추론 점수도 o1 시리즈 다음으로 높은 점수 기록 qwq 보다도 높음
다음번엔컬럼도같이찍어주세요
제미나이 잘 몰라서 그러는데 플래쉬가 오픈ai로 치면 mini급인 거? 그러면 정식버전? Pro버전이 따로 있다는 건가?
ㅇㅇ mini 정도 라인업으로 생각하면 됨
ㄱㅅㄱㅅ 정식버전 기대되네