https://paperswithcode.com/paper/reinforcement-learning-in-possibly
기존의 인공지능은 시스템 전환과 보상 함수가 시간에 지남에 따라 일정해야 한다고 해.
그런데 이게 실제로는 매우 제한적이고 교통 신호 제어, 로봇 공학 및 모바일 건강을 포함한 여러 애플리케이션에서 위반될 가능성이 있다고 하네.
이 논문에서는 추가적인 온라인 데이터 수집 없이 이미 학습한 데이터만으로도 충분히 좋은 성능을 발휘할 수 있다고 하네!
이런 쪽의 연구가 진행된다면 보다 적은 데이터으로도 여러가지 상황에 대비하는 로봇이 나올 수 있을 것 같다ㅎㅎ
기존의 인공지능은 시스템 전환과 보상 함수가 시간에 지남에 따라 일정해야 한다고 해.
그런데 이게 실제로는 매우 제한적이고 교통 신호 제어, 로봇 공학 및 모바일 건강을 포함한 여러 애플리케이션에서 위반될 가능성이 있다고 하네.
이 논문에서는 추가적인 온라인 데이터 수집 없이 이미 학습한 데이터만으로도 충분히 좋은 성능을 발휘할 수 있다고 하네!
이런 쪽의 연구가 진행된다면 보다 적은 데이터으로도 여러가지 상황에 대비하는 로봇이 나올 수 있을 것 같다ㅎㅎ
댓글 0