아마 알파스타가 기상천외한 전략 같은거 본격적으로 쓰는 건 초기 학습 단계에서 인간들의 리플레이를 안쓰게 될 시점일 것 같다.


알파고 때도 처음엔 아마나 프로 기사들 기보를 입력해서 하다가 나중엔 처음부터 알파고 끼리 붙어서 학습을 했거든.


블로그 보니 지금은 인간들 리플레이로 초기 학습하고 대략 2주 동안 서로 대전 시켜서 훈련시키는 방식 같은데, 나중에 알파고 처럼 

리플레이 없이 처음부터 자체 대전을 할 수준이 되면 별의 별 신기한 전략들이 나오지 않을까 싶다.