https://arxiv.org/abs/2203.00251
= 빠른 모방, 정책의 재사용을 통한 원샷 학습
다 일일이 학습시켜줘야 되는 기존의 방식에서
우리가 생각하는 간단한 안드로이드 조차도 여러가지 일을 할줄 알아야되는데
그를 위해선 정책 재사용, 모듈식 학습, 어셈블리 학습, 전이 학습, HRL(계층적 강화 학습)등이 빠르게 가능해야함
근데 저 과학자들은 2계층의 계층적 알고리즘으로 처음부터 배우는 것을 피해 원샷 학습을 수행했다함
이미 중복일 가능성이 높지만 검색하다가 찾아서 올림
2025년 큰거 온다...!
애휴..하루에 ai논문이 30 40개씩 올라오는데 아무거나 들고와서 큰거론다 하면 agi가 25 년에 오는거임? ㅋㅋ
ㅋㅋㅋㅋㅋㅋㅋㅋㅋㅋㅋㅋㅋㅋㅋㅋㅋㅋ