https://arxiv.org/abs/2203.00251


= 빠른 모방, 정책의 재사용을 통한 원샷 학습


다 일일이 학습시켜줘야 되는 기존의 방식에서 


우리가 생각하는 간단한 안드로이드 조차도 여러가지 일을 할줄 알아야되는데 


그를 위해선 정책 재사용, 모듈식 학습, 어셈블리 학습, 전이 학습, HRL(계층적 강화 학습)등이 빠르게 가능해야함


근데 저 과학자들은 2계층의 계층적 알고리즘으로 처음부터 배우는 것을 피해 원샷 학습을 수행했다함



이미 중복일 가능성이 높지만 검색하다가 찾아서 올림


2025년 큰거 온다...!