https://arxiv.org/abs/2203.00251

안드로이드가 올려면 정말로 다양한 것들을 해낼 수 있어야 한대!

예를 들어서 문 열기, 설거지, 책상 닥기 등등..

그런데 그게 될려면 정책 재사용, 모듈식 학습, 어셈블리 학습, 전이 학습, HRL(계층적 강화 학습) 등이 필요하다고 하더라.

그런데 이게 학습 효율성이 좋지 않고 훈련을 위해 엄청나게 큰 용량이 필요하다고 하더라.

이걸 피하려면 처음부터 배우는 것을 피해서 원샷이나 몇 번으로 충분히 빠르게 학습해야 한다고 하네.

그런데 이 과학자들은 2계층의 계층적 알고리즘으로 처음부터 배우는 것을 피해 원샷 학습을 수행했다고 하네!


이게 원샷 학습이 agi에서 정말로 핵심적인 부분 중 하나인 것 같은데 진짜 엄청난 논문인 것 같다..