AI가 학습하는 데이터셋 중에 인류에 적대적이거나 악의적인 텍스트는 비중이 매우 작고


특히 가치판단과 관련된 분야(철학, 윤리학, 사회과학)에 있어서 더욱 그렇기 때문에


사전학습 모델이 인류에 적대적인 가치관을 학습할 확률이 매우 낮을 것.


오히려 파괴지향적 집단(테러리스트, 정치or종교극단주의자, 권위주의 정권)이 


처음부터 인류(의 특정집단)을 해칠 목적으로 하거나


특권을 유지, 강화하고자 지배계층의 이익 극대화만을 추구하도록 AI를 설계하는 경우가


실질적 위협이 될 것.