그렇게 학습시킨 AI는 이기는거밖에 못한다는게 문제죠


게임에서 써먹으려면 적당히 지는 법을 알아야 하는데 강화학습으로 학습시킨 AI는 그걸 못하죠


그렇다고 보상식 세분화하면 학습성능 떨어지고, 좀 덜 학습시킨다고 골고루 덜 학습시킨 성능 나오는것도 아니고



게다가 강화학습이라는게 100퍼센트 무결점 자랑하는것도 아니라


이세돌한테 깨진거처럼 경험해보지 못한 수 나오면 이상한 행동을 할 수 있으니까...


한번 실수하면 크리티컬한 자율주행같은거에도 못써먹고



로보틱스쪽에선 자연스러운 움직임 학습하는데 나름 잘 써먹는거 같지만




어쨌든 개인적으론 특이점같은게 오려면 AI 겨울이 한번 더 왔다가 지나가야 될거같아요.