그렇게 학습시킨 AI는 이기는거밖에 못한다는게 문제죠
게임에서 써먹으려면 적당히 지는 법을 알아야 하는데 강화학습으로 학습시킨 AI는 그걸 못하죠
그렇다고 보상식 세분화하면 학습성능 떨어지고, 좀 덜 학습시킨다고 골고루 덜 학습시킨 성능 나오는것도 아니고
게다가 강화학습이라는게 100퍼센트 무결점 자랑하는것도 아니라
이세돌한테 깨진거처럼 경험해보지 못한 수 나오면 이상한 행동을 할 수 있으니까...
한번 실수하면 크리티컬한 자율주행같은거에도 못써먹고
로보틱스쪽에선 자연스러운 움직임 학습하는데 나름 잘 써먹는거 같지만
어쨌든 개인적으론 특이점같은게 오려면 AI 겨울이 한번 더 왔다가 지나가야 될거같아요.
저걸로 강인공지능? 수저로 시스티나 대성당 건설하기지
ㄹㅇ 강인공지능나오려면 한참남음