진화알고리즘은


개체에 적합도 함수로 점수를 매겨서 이 점수가 높은 개체를 자연선택하고,교배, 돌연변이 시킨다


다음세대에서 또 점수가 높은 개체를 선택하고 이게 반복되면


적합도 점수를 최대화하는 개체가 태어나게 된다


즉, 점수 최대화라는 특징이 있다



강화학습도


보상을 최대화하는 행동을 선택한다


구체적으로는 행동들에 의한 누적보상합이 최대가 되는 행동에 높은 가치를 매기는 가치함수를 통해서다



즉, 진화알고리즘이나 강화학습이나


점수최대화라는 공통점을 가지고있고


진화는 실제로 인간같은 고등지능을 만들어냈기때문에


진화알고리즘과 강화학습이 공통점을 가지고있다면


강화학습도 고등지능을 만들어낼 가능성이 있다