그냥 실제로 저 co scientist method 쓰면 gpqa 밴치 점수가 실제로 80점대로 뻥튀기 되는게 확인됨.
장난감 같은거 아니고 실제로 벤치 뻥튀기 되는거보면 의미있는건가본데 o1 pro 랑 비슷한데 좀더 복잡한
[일반] 구글 co scientist 근들갑 아니네
익명(dlsjftldk)
2025-02-20 00:26
추천 7
댓글 4
다른 게시글
-
최단기 퇴물 [6][일반] 바다기린(hancomputer) | 25.02.20추천 6
-
구글은 챗봇 이외분야에서 결과를 내놓네 [1][일반] 익명(124.51) | 25.02.20추천 1
-
과도기 < 이새끼 근들갑이었네 [3][일반] 익명(218.54) | 25.02.20추천 1
-
에이전트 시스템이 재귀개선은 아니지;; [6][일반] 약팔이아님(vital7966) | 25.02.20추천 0
-
가설 검증은 어떻게 할까[일반] 익명(1.226) | 25.02.20추천 0
-
알트만 지가 1황인줄알고 [3][일반] fhkteoRh(bkn001) | 25.02.20추천 0
-
솔직히 o3 딥리서치도 새로운 가설을 만드는 능력은 제로인데 [1][일반] 익명(wooden6879) | 25.02.20추천 0
-
???:치타는 웃고있다....[일반] Lily(fraction3193) | 25.02.20추천 0
-
머스크랑 메타 대가리후려서 글카 구글에바치면안되냐? [6][일반] 익명(218.54) | 25.02.20추천 1
-
빨리 저걸로 암치료제나 만들고 agi 만들라고 [1][일반] 익명(124.54) | 25.02.20추천 1
헉
그저 goat
과학연구에 새로운 길을 연것이나 다름없음.. 이게 동일한 방식으로 인문학, 사회학, 경영학, 경제학 모든 분야에도 다 적용될것 같음.