요번 연구에서 인공지능 훈련시키는 게임환경은 PBT(유전알고리즘) 써서 만들었다면서 정작 왜 그 게임에서 훈련할 인공지능은 강화학습으로 만듬? 왜 두가지 방식을 혼용하는거지? 강화학습이 우월하다면 게임환경생성도 강화학습으로 하면 될일인데 그렇지 않다는건 게임환경 생성은 강화학습으로 다룰수 없다는 얘긴가? - dc official App
장단이있는거지
애초에 그렇게 단편적으로 우열을 따질 수 없음.