훈련환경 = 게임


개체가 일반능력(범용지능)을 가지기 위해 필요한 게임은 PBT(진화알고리즘)로 만들고


일반능력을 측정하기 위한 게임은 절차적생성(알고리즘, 랜덤)으로 만듬



이게 예전에 "reward is enough" 였나 그 논문에서 복잡하고 세밀한 환경을 만들면 강인공지능을 만들수 있다 그랬거든


근데 그 반박이 "환경을 만들기 위해서 매우 진보된 인공지능이 필요할수 있다" 였음



그걸 딥마인드는


PBT와 절차적생성으로 해결한거같다..


그냥 그렇다고..