1. 개체가 게임을 이기면 개체에게 보상을 준다
2. 개체가 게임을 이기면 게임에게 보상을 준다
3. 개체와 게임 모두 강화학습 에이전트
이러면 게임은 개체가 이길수 있는 게임을 여러개 만들게되고
개체는 여러게임을 깰수있도록 발전하면서 범용지능이 갖춰짐
1. 개체가 게임을 이기면 개체에게 보상을 준다
2. 개체가 게임을 이기면 게임에게 보상을 준다
3. 개체와 게임 모두 강화학습 에이전트
이러면 게임은 개체가 이길수 있는 게임을 여러개 만들게되고
개체는 여러게임을 깰수있도록 발전하면서 범용지능이 갖춰짐
해당 댓글은 삭제되었습니다.
왜?
왜못만드는지 이유점
인간이 설계하는게 아니라 강화학습 에이전트보고 시킨다고
실제로 딥마인드는 Xland 연구에서 강화학습 에이전트를 쓰고 그 Task 인지 하는것들을 진화알고리즘으로 생성함
강화학습 에이전트 못만들거같으면 진화알고리즘 쓰면 되는거아님?
안읽은건 너잖아;; 논문에 에이전트와 환경을 공진화 시킨다고 나와있음;;
진화알고리즘 뭔지몰라? 걍 나무위키처도 나오던데
키워드가 유용하고 쓸모있으니까 키워드를 이용하는거지 않겠냐?
무슨근거로 내가 알고리즘이 뭔지 모른다고 생각하는지 근거좀 대줄래?
아는것도 없는건 자기면서 왜 다른사람보고 근거없이 아는거 없다고 우김?
구체적인건 전문가들이 해결하면 되는거고 대략적인 얼개만 제시하는게 왜 사기꾼임?
내가 말을 좀 바꿔해서 그렇지 실제로는 딥마인드에서 훈련환경(task)를 PBT(유전알고리즘변형) 버전으로 진화시켜서 만들고 있는게 맞는데?
오히려 니가 논문이해를 전혀못했다는게 드러나네 OPEN-ENDED 열린 개방형 훈련, 즉 지속적으로 새로운 게임을 훈련시켰더니 거기서 범용성을 가지게되었다 는게 논문내용이고 AGI의 정의를 "인공 일반지능" 이라고할때, 범용성과 일반성은 일맥상통함
너는왜 모르면서 아는척함?
진짜 너같은 역겨운존재가 왜사는지 이해가안됨..
그냥 사람화나게하려고 문장쓰는 수준하며 머리는 멍청하지 아는것도 없지.. 게다가 역겹기까지..
논문내용도 모르고 지껄인건 지면서 뭔 개소리래.. ㅋㅋ 개소리는 지가하면서
공부오래해도 멍청한거보면 그냥 공부도 그만두는게 좋을듯 ㅋㅋ