여기다가 신경망 얹어서 혼자 놀고 시펐는데...오목 레베루에서는 그럴 필요 없을듯.그리고 피드 데이터 구하는 것도결국 몬테카를로 존나 돌려서몬테카를로 기반으로 피드를 주니몬테카를로보다 성능도 구릴거 가타 ㅇㅅㅇ
몬테카를로 없이 뉴럴넷으로만도 한번 해보셈
기냥 뉴럴넷 기반으로 해서 효율이야 어쩌건 간에 계속 계속 시뮬레이션 돌리는 그런식인가
시뮬레이션이 강화학습에서 시뮬레이션 말하는거면 될수도 있을듯. 알파고같은경우 데이타셋가지고 뉴럴넷만 달랑 훈련시켜도 1단정도 나옴