일리야가 쓴 논문에 있는 '검증모델' 이라는 말에 빠져서
재귀개선 되는 줄 알고 혼자서 존나 브레이킹 댄스 추면서 특이점 ㅇㅈㄹ 하고 있네
지금 o1 이 가지고 있는 추론예제 데이터 들도 인간 라벨러가 검증모델이 내놓은 결과에 대해서 한땀한땀 수작업으로 검증하고 넣은 결과들임
검증모델조차도 인간라벨러가 수작업으로 넣은 데이터들에 의존하고 있기 때문애 자신의 수준을 넘는 추론예제에 대한 참과 거짓을 분별하는 프로세스에 대해서 정확도가 떨어질 수 밖에 없음
결국 현재 COT 강화학습 방식을 차용하고 있는 OPENAI GPT 모델은 인간이 내놓은 정답이 정해져있는 추론문제들을 추론하면서 천문학적인 '옳은 추론예제들을' 학습하기 시작하면서 인간지성의 최정점에 도달하게 될거임
그런데 문제는 여기서 발생한다
그 모든 추론예제들을 학습해서 마개조 되어있는 GPT 에게 수학에 대한 새로운 증명식을 유도하는 개방형 추론을 요구했을때
그 추론예제가 맞냐 틀리냐를 어떻게 검증 할 수 있냐는 거임
같은 수학자들 끼리도 자신 보다 수준이 높은 수학자의 증명에 대해서 옳고 그름을 따지지 못하는 상황임
GPT 의 지능을 향상 시킬려면 '옳은 추론예제' 를 학습시켜야 만이 가능한건데
GPT 가 내놓은 추론예제에 대해서 '옳다 그르다' 를 판별할 수 없을정도로 그 수준이 높아진다면
대체 무엇을 근거로 이것을 검증해줄수있냐는거지
대체 내 말에 대해서 수용이 아니라 반론으로 대적하는 이유를 모르겠음
논리적으로 전혀 틀린말이 아니지 않음?
그래서 리만가설과 같은 그 가설이 참임을 절대적으로 가정해놓고 시작하는 난제들이 필요한거임
그냥 그 가설이 맞다고 가정해 놓고
그 가설을 증명하기위한 추론 증명식들에 대해서 그 가설을 근거로 참과 거짓을 판별해야 함
그 가설에 부합하면 참이고 부합하지 않으면 거짓이지 그렇게 루프를 돌려놓아야한다는거
이 말 맞긴함 나도 논문 읽어보면서 검증모델 이라는 말에서 좀 미심쩍더라고 검증못할거 같은데 어떻게 한다는거?
인간이 만든 추론예제로 달성가능한 고점 찍어놨는데 그 이상 추론이 안되면 그 AI랑 협력해서 새 우물 파야지 같은길로 계속 갈 이유가? 지금 O1 구조로는 될수도 안될수도 있는거지 존나 확언하듯 말하네
그러니까 그 '새 우물' 이 리만가설 같은 참임을 가정하고 추론할 수 있는 난제 들이라고
그리고 추론도구로 활용할 수 도 있고
게시글에 "그래서 리만가설과 같은 그 가설이 참임을 절대적으로 가정해놓고 시작하는 난제들이 필요한거임 그냥 그 가설이 맞다고 가정해 놓고 그 가설을 증명하기위한 추론 증명식들에 대해서 그 가설을 근거로 참과 거짓을 판별해야 함 그 가설에 부합하면 참이고 부합하지 않으면 거짓이지 그렇게 루프를 돌려놓아야한다는거" 이렇게 대놓고 대문짝 만하게 써놓았는데 니 눈 앞엔 이 간단한 4줄로 된 문장조차 못읽는거임?
그리고 '그 이상 추론이 안된다' 라고 말한적 없고 '그 이상 추론은 가능하나 검증이 불가능하다' 라고 말했는데? 왜 남이 말한걸 각색하냐
누구랑 뭔 싸움을 했는지는 모르겠지만 과학사를 봤을때 새 우물이 될 추론예제를 인간 스스로 판 사례가 수두룩한거 보면 지금 방법으로 고점 찍고나서 새 돌파구는 얼마든지 나올것같다. 단순히 O1 현재 기술로는 고점이 정해져있다는 주장에는 반쯤만 동의함.
새 돌파구가 안나온다는 말을 한적이 없는데
같은길로 계속가야한다 또는 새 돌파구가 안나온다는 말을 한적이 없는데 난 단한번도 그래서 새롭게 제시하는게 '절대적 참을 가정한 난제' 를 통해서 해결해보는게 어떻겠냐 고 의견을 개진하는거고
새끼 존나 날서있노 진정이나 해라 내가 니 똥글을 주의깊게 이해할필요가 있냐 슥 훑어보고 내 똥글 싸는거지
최소한 남 비판할거면 제대로 읽어보고 비판해야되는거아닌가
길가다가 언질하는 할배조차도 최소한 그 상황이 어떤 상황인지는 이해하는 판국에 ㅋㅋㅋㅋ
그래도 밑에 ㅇㅇ 마냥 경지앵무새 처럼 개 헛소리 안해서 고맙긴함 ㅇ
맨 첫 두줄이 현재기술로는 재귀개선 불가능하니 오해하지 말라고 못박아놓고 뒤에서 소심하게 제시한 4줄짜리 개진의견(사실상 똑같은 추론예제 학습임)이 사실상 참으로 가정가능한 새 추론예제로 재귀개선 가능하다는게 대충봤을때는 그냥 존나 모순으로 보임 ㅋㅋ 니 글 구조도 문제있으니 주장을 확실히 해라 앞에서는 안된다 뒤에서는 된다
글쎄 나는 절대로 '재귀개선이 절대적으로 불가능하다' 라고 말한적 없는데 이 제목 이후에 "현재 COT 강화학습 방식을 차용하고 있는 OPENAI GPT 모델은 인간이 내놓은 정답이 정해져있는 추론문제들을 추론하면서 천문학적인 '옳은 추론예제들을' 학습하기 시작하면서 인간지성의 최정점에 도달하게 될거임" 이 문장을 말함으로써 재귀개선이 현재로서 불가능한 이유를 '정답이 정해져있는 추론문제들을 추론하면서 천문학적인 '옳은 추론예제들을' 학습하기 시작하면서' 라고 묶어둠 그리고 '절대적 참' 을 가정할 수 있는 문제설정을 통해서 새 추론예제들을 통한 재귀개선이 가능하게 될지도 모른다 라고 말함으로써 니가 이야기 하고 있는 '새 우물' 에 대한 이야기로 마무리 함
고로 이 게시글의 내용은 '재귀개선은 절대적으로 불가능하다' 가 논점이 아니라 '재귀개선은 현재로선 불가능하나 새로운 문제설정을 통해서 (새 우물) 가능하게 될지도 모른다' 가 주요논점으로 파악하는게 맞지않음? 내가 모순인게 아니라 니가 제대로 안읽고 댓글 남긴거 같은데
밑에 ㅇㅇ 앵무새 새끼랑 동족이 한마리 더있었노 ㅋㅋㅋ
지금 o1 이 가지고 있는 추론예제 데이터 들도 인간 라벨러가 검증모델이 내놓은 결과에 대해서 한땀한땀 수작업으로 검증하고 넣은 결과들임 => 아님
맞음
게이는 "최상의 보상 모델을 학습하는 데 사용된 800,000개의 단계 수준 인간 피드백 레이블의 전체 데이터 세트인 PRM800K도 출시합니다." '인간 피드백 레이블' 이라는 단어를 못읽는거노?
내가 똑똑한건 아니라 잘 몰라서 물어보는건데 검증 못한다는게 뭔말임? 예시가 있음? ai가 내논 증명식보고 막히는 부분 하나하나 다시 물어보면 되는거 아님?
아까부터 말하는게 묘한데 님 리만가설이 정확히 뭔 줄 암?
수학은 증명보조기로 검증하면돼