<<Gemini Ultra 실시간 대화 동영상시연(자비스급 출력속도)>>

시발! gpt4넘었다 치타가 달리기 시작했다!


얼마 후 -

영상조작으로 밝혀짐, mmlu 원샷으로하면 gpt4보다 딸림.
구글 측 "곧 실제로도 가능해질것"


<<Claude 3 발표>>

와 시발 사람이랑 대화하는거같다.. 소름돋는다
"클로드가 gpt4넘었다." "엔스로픽 추가투자받음 oai ㅈ됨 ㅅㄱ"


얼마 후 -

확실히 좋긴한데 굳이 따지자면 언어 쪽 특화 모델인듯
멀티모달은 어림도없고 추론능력도 gpt4랑 이기고 지고 하네..



<<Gemini 1.5 Pro발표>>

1공개한지 얼마나됐다고 벌써 1.5냐 치타속도 실화냐? ㅋㅋㅋ
Gemini 1.5 pro는 책한권을 통으로 넣고 원하는 값을 출력해준...

Sora발표, Gemini1.5는 추론, 환각문제 등 여전히 gpt4에 발려  - (최단퇴)




<<Gpt4-turbo발표!>>
이제 gpt4의 성능은 개쩔어졌고, 너네들은 놀라자빠질것

얼마 후 -

??? : 차이 잘 모르겠는데? 오히려 성능저하 전 초기gpt4가 더 좋았다.



<<gpt2, 연이어 also 아레나에 깜짝공개>>

와 also는 진짜다. 코딩능력 넘사로 개쩔어졌고 한방에 잘 뽑아낸다..
이정도면 gpt 4.5 쌉가능인듯?

얼마 후 -

추론능력은 별 차이 없는데?
오히려 gpt4가 맞추는거 틀리기도 함






특정 부분에서  gpt4를 넘어서는 모델들이 하나 둘 등장하고 있지만
결과적으로 추론,재귀개선,환각문제에서는 gpt4와 유의미한 차이를 보이는 모델은 여태까지 없음.

진짜 gpt5에 기대 몰빵이다.
만약 5가 4랑 추론능력, 재귀개선(극부분적으로라도), 환각문제에서
차이 못벌려놓으면 llm 정체된게 맞음 ㄹㅇ 좆.된.다