10x10 평면에서
로봇이 모든점을 최소 한번 방문하고 마지막으로 10,10지점까지 가야함.
알고리즘 생각이 안나서
인풋 노드 100개(각 점의 상태(방문, 미방문, 장애물))
히든레이어 1~100(시그모이드)
아웃풋 노드 1개(쑤레쉬홀드),
(좌회전,우회전, 직진) 중 하나의 행동
제 설계 어떤지 평가랑 더 좋은 방안 있으면 추천 부탁드립니다~
로봇이 모든점을 최소 한번 방문하고 마지막으로 10,10지점까지 가야함.
알고리즘 생각이 안나서
인풋 노드 100개(각 점의 상태(방문, 미방문, 장애물))
히든레이어 1~100(시그모이드)
아웃풋 노드 1개(쑤레쉬홀드),
(좌회전,우회전, 직진) 중 하나의 행동
제 설계 어떤지 평가랑 더 좋은 방안 있으면 추천 부탁드립니다~
- dc official App
이건 강화학습으로 해야 하는거 아니야? ㅇㅅㅇ; Policy Gradient 써봐
ㄴ 아 맞다, 여기선 리워드 함수를 어떻게 해야할지 감이 안오는데. 리워드 함수 어떻게 설정해야할지도 알면 알려주세요 ㅋㅋㅋ - dc App
http://www0.cs.ucl.ac.uk/staff/D.Silver/web/Teaching_files/pg.pdf
ㄴ 지금 보고왔는데 policy gradient 매우 적합하네요. - dc App
ㄴ 위 링크 pdf가 안뜨네요. 다른 사이트에서 찾아봤습니다. 감사합니다~