포켓몬 플레이 방법을 따로 학습시키지 않고 텍스트랑 이미지만 졸라 쳐넣은 모델이 알아서 저기까지 간다고?개쩔지 않냐?내 눈에는 LLM이 확률론적 앵무새를 넘을 수 있다는 강력한 증거처럼 보이는데
보면 공간인지능력이 부족하긴하
그건 어쩔 수 없지...
스트리밍 1시간보고와라 존나 빡통인데
오직 텍스트랑 이미지만 학습된 모델이 빡통짓을 하면서도 꾸역꾸역 저기까지 간 게 대단하단 소리였음
방송 직접보면 그말 쏙 들어갈걸 ㅋㅋ
씁... 그정도냐...
클로드도 그랬고 breakthrough 따라서 가는거긴할걸 정보가 아예 없는건 아닌걸로 사람 실제 플레이를 강화학습한건 아니겠지만
아 그럴 수도 있겠네...
팩트) 금붕어도 3195시간 걸려서 깼다
https://m.dcinside.com/board/aoegame/15484607
시바 ㅋㅋㅋㅋ 뭔 ㅋㅋㅋ
이건 뒤지면 특정장소 다시시작 조건 있어서 그런듯 이론상 못깨지 원래는
근데 플레이 방법이 학습 안되어 있단건 어케 아는거임? 구글쯤이면 포켓몬 게임이 오래된거라 공략이나 정보, 플레이 방법도 데이터에 다 흡수되어 있지 않음??
아무 정보나 다 때려넣는게 아니니 모르지 않을까
마이너 게임이면 모르겠다만 포켓몬 아이피면 너무 유명하잖어
내가 말한 플레이 방법 학습이란건: AI가 포켓몬 게임을 하면서 "특정 조건에서 특정 입력을 수행하면 보상을 주거나 처벌하면서 강화학습" 시키는 걸 말함 AI 한테 포켓몬을 플레이시키면서 강화학습 시키진 않았을거란 말야
그건 당연한 전제여야지 - dc App