현시점의 강화학습은 정해진 보상체계 내에서 최적값을 찾는 방향으로 행동을 교정하는 방식으로 이뤄지잖아


근데 스스로 상황에 맞춰 보상체계를 바꾸는 능력이 탑제된 인공지능이 나오지 않는 이상 AGI는 힘들다고 보거든
이런 기술이 있는지 모르겠네