https://arxiv.org/abs/2203.02214
어려운 말들이 섞여있지만 내가 생각하기에 중요한 논문인것 같아서 공유해본다.
모방 학습의 경우 전문가의 행동을 관찰할 필요성을 줄임으로써 모방 학습의 실제 범위를 현실 세계로 확장이 가능하다고 하더라.
하지만 기존의 해답은 전문가가 대상에 대한 계획을 고려하지 않고 그냥 데이터를 상태를 읽고 그에 따라 행동하는 방법만 학습이 됬다고 하더라
이는 시연을 활용하는 능력을 제한하고 유연적으로 생각하는 것을 제한한다고 하더라.
그래서 이 과학자들은 계획과 완전히 분리할 수 있는 dePO라는 인공지능을 개발했다고 하네.
이 dePO는 적대적 훈련을 통해서 지식을 완전히 다른 영역에서 활용할 수 있게 되고 심지어 이 지식 자체를 일반화할 수 있다고 하더라.
이에 따라 최고의 모방 학습을 달성하면서 일반화된 목표와 계획조차도 학습할 수 있다고 하네!
오오.. 이건 진짜 agi각 아닌가ㅋㅋ 슬슬 인공지능 스스로가 지식을 일반화하고 목표와 계획조차도 학습할 수 있다는 건가?ㅎㅎ
어려운 말들이 섞여있지만 내가 생각하기에 중요한 논문인것 같아서 공유해본다.
모방 학습의 경우 전문가의 행동을 관찰할 필요성을 줄임으로써 모방 학습의 실제 범위를 현실 세계로 확장이 가능하다고 하더라.
하지만 기존의 해답은 전문가가 대상에 대한 계획을 고려하지 않고 그냥 데이터를 상태를 읽고 그에 따라 행동하는 방법만 학습이 됬다고 하더라
이는 시연을 활용하는 능력을 제한하고 유연적으로 생각하는 것을 제한한다고 하더라.
그래서 이 과학자들은 계획과 완전히 분리할 수 있는 dePO라는 인공지능을 개발했다고 하네.
이 dePO는 적대적 훈련을 통해서 지식을 완전히 다른 영역에서 활용할 수 있게 되고 심지어 이 지식 자체를 일반화할 수 있다고 하더라.
이에 따라 최고의 모방 학습을 달성하면서 일반화된 목표와 계획조차도 학습할 수 있다고 하네!
오오.. 이건 진짜 agi각 아닌가ㅋㅋ 슬슬 인공지능 스스로가 지식을 일반화하고 목표와 계획조차도 학습할 수 있다는 건가?ㅎㅎ
댓글 0