그건 수학이 아니라 퍼즐맞추기야.. 정답률 1.2% 그딴 거 의미가 없어.
지금 벤치에서 쓰이는 수학문제는 아예 다른 성격임.
그 수능테스트조차 못해서 답만맞추고 풀이틀린글 ㅈㄴ많이올라옴 그냥벤치만보셈
성격이 다르다고.. 뭐가 쉽고 뭐가 어려운게 아니라.
뭐던간에 인간의 지능을 모방한다는 ai에게 좋은 테스트 지표 아니겠음?
이 댓글은 게시물 작성자가 삭제하였습니다.
갤에서 애들이 신 모델 나올 때마다 테스트하는 모의고사, 수능 문제는 이전 모델들이 잘 못 풀었던 소수의 문제들임. 신 모델이 그 문제를 풀 수 있는 궁금해서 갤러들이 개인 테스트 해보는거고, 님이 말하는건 matharena.ai 벤치마크 같은 곳에 올라오는 경시 대회 문제, 증명 문제들 아님? 외국에서는 이미 작년 말이나 올해 초 모델로 물리학 박사 과정 문제 풀이 한거 유튜브에 올라오기도 함
그 수능테스트조차 못해서 답만맞추고 풀이틀린글 ㅈㄴ많이올라옴 그냥벤치만보셈
성격이 다르다고.. 뭐가 쉽고 뭐가 어려운게 아니라.
뭐던간에 인간의 지능을 모방한다는 ai에게 좋은 테스트 지표 아니겠음?
이 댓글은 게시물 작성자가 삭제하였습니다.
갤에서 애들이 신 모델 나올 때마다 테스트하는 모의고사, 수능 문제는 이전 모델들이 잘 못 풀었던 소수의 문제들임. 신 모델이 그 문제를 풀 수 있는 궁금해서 갤러들이 개인 테스트 해보는거고, 님이 말하는건 matharena.ai 벤치마크 같은 곳에 올라오는 경시 대회 문제, 증명 문제들 아님? 외국에서는 이미 작년 말이나 올해 초 모델로 물리학 박사 과정 문제 풀이 한거 유튜브에 올라오기도 함