2점이 말이되나? 일단 객관식 보기는 다 지웠다는 말인가?
LG AI 수능 수학 24점이면 7등급 정돈가? 에라이 다 때려치워라. 오늘 이 기사보니까 화나네.
제미나이가 가장 높게 나온걸로봐서 이미지를 그대로 멕인것같은데
애초에 제대로 측정된게아닌거같음 그록 82점이면 3점짜리두개틀리거나 2점짜리를틀렸다는건데 말이됨? 그건 중학생도 품
저거 아마 비추론모델이라 그럴 걸. GPT4도.....저거보단 높았던 것 같긴한데 비추론의 한계지 뭐. 아마 저 기업들한테 수능 수학으로 벤치 할 거라고 했으면, 치팅으로는 아니어도 분명 추론모델 준비했을거고 저거보다 점수는 준수하게 나왔을거임.
구글 제미나이는 92점 그래도 일등급인데.
https://github.com/hehee9/2026-CSAT이런 식으로 해야 제대로 나올텐데 말이야
저 교수팀은 진짜 중국한테 사주받았나? ㅅㅂ 볼때마다 황당함 아니 교수라는 인간들이 추론기능도 어떻게 쓰는지 모르고 굳이 파이썬으로 호출하고 지랄을 했더만
찾아보니 AI연구하는 교수던데 미스테리야
@알트만과머스크 특정 목적이 있다고 봐야... 교수면 더더욱 이상함. 왜 저렇게?
특갤러도 8B가 의미하는 뜻을 모르는데, 일반인은 오죽할까. 너무 악의적인 그래프임
제미나이가 가장 높게 나온걸로봐서 이미지를 그대로 멕인것같은데
애초에 제대로 측정된게아닌거같음 그록 82점이면 3점짜리두개틀리거나 2점짜리를틀렸다는건데 말이됨? 그건 중학생도 품
저거 아마 비추론모델이라 그럴 걸. GPT4도.....저거보단 높았던 것 같긴한데 비추론의 한계지 뭐. 아마 저 기업들한테 수능 수학으로 벤치 할 거라고 했으면, 치팅으로는 아니어도 분명 추론모델 준비했을거고 저거보다 점수는 준수하게 나왔을거임.
구글 제미나이는 92점 그래도 일등급인데.
https://github.com/hehee9/2026-CSAT
이런 식으로 해야 제대로 나올텐데 말이야
저 교수팀은 진짜 중국한테 사주받았나? ㅅㅂ 볼때마다 황당함 아니 교수라는 인간들이 추론기능도 어떻게 쓰는지 모르고 굳이 파이썬으로 호출하고 지랄을 했더만
찾아보니 AI연구하는 교수던데 미스테리야
@알트만과머스크 특정 목적이 있다고 봐야... 교수면 더더욱 이상함. 왜 저렇게?
특갤러도 8B가 의미하는 뜻을 모르는데, 일반인은 오죽할까. 너무 악의적인 그래프임