강화학습의 끝이 어디일까?
인간이 지금까지 알아낸 모든 것?
아니면 과학, 수학, 코딩에 대해 인간이 알아낸 것 + 인간이 알지 못했던 모든 것?
ASI까지 가려면 후자여야 할텐데
https://m.dcinside.com/board/thesingularity/734261?headid=&recommend=&s_type=subject_m&serval=%EA%B0%95%ED%99%94이거읽어봤음?
안읽어봤음 함 읽어볼게
AGI까지만 가면 됨. 재귀개선이 가능한 수준. 그러면 ASI까지는 가게할 지 말 지 선택의 영역으로 바뀌지. 그러니까, 강화학습. 컨텍스트 길이 증가. 이런 것들이 AGI를 만들기에 충분한가? 이것만 보면 됨.
인간이 알아내는게 중요한게 아니라 어떻게 결과를 확인하고 보상을 줄지에 대한 정책이 강화학습임. 정말로 최적화된 최고의 강화학습 알고리즘만 있으면 인간이 뭐 안 해도 모델 스스로 현실세계에서 경험을 쌓아서 AGI가 될거임..
https://m.dcinside.com/board/thesingularity/734261?headid=&recommend=&s_type=subject_m&serval=%EA%B0%95%ED%99%94
이거
읽어봤음?
안읽어봤음 함 읽어볼게
AGI까지만 가면 됨. 재귀개선이 가능한 수준. 그러면 ASI까지는 가게할 지 말 지 선택의 영역으로 바뀌지. 그러니까, 강화학습. 컨텍스트 길이 증가. 이런 것들이 AGI를 만들기에 충분한가? 이것만 보면 됨.
인간이 알아내는게 중요한게 아니라 어떻게 결과를 확인하고 보상을 줄지에 대한 정책이 강화학습임. 정말로 최적화된 최고의 강화학습 알고리즘만 있으면 인간이 뭐 안 해도 모델 스스로 현실세계에서 경험을 쌓아서 AGI가 될거임..