https://twitter.com/wojczarnecki/status/1482490893563215882?t=v5xuw_E5pYsBhwHKqhOfIw&s=19GPT3는 unspuervised learning으로 레이블없이 학습했고알파제로 및 알파스타2는 셀프플레이로 성능 증폭시켜서 GM달성함이미 셀프티칭, 재귀개선 가능가토는 ood 문제도 품AGI는 매우 가까이에 와 있음마음의 준비하셈
특갤에서 말하는 재귀개선이란건 자기 스스로 지능을 끌어올릴 수 있는 상태를 말하는거 아님? 스스로를 재설계하는
혼자 되도 않는 논리에 빠져있네 아직 셀프티칭 자가개선 장기기억 3개 기술 존재하지 않음
누차 말하는데 핵심은 장기기억임. 그리고 아직 이거 되는거 없음.
장기적으로 뭘 기억한다는거임? 학습 목표? - dc App
알파고는 좌표가 정해져있잖아..
정확한 좌표가 아니면 알파고도 바로 무너져버림.. 겨우 19x19도 좌표 사이에 두면 바로 에러나는데 세상을 어떻게 정의하게?
딥마인드개방형 학습 에이전트 보셈
https://www.deepmind.com/blog/generally-capable-agents-emerge-from-open-ended-play