대부분 벤치 데이터셋에 대한 오버피팅일 확률이 높음. 매개변수는 정보이론적으로 정보를 어떻게 압축시켰느냐에 관한 수치인데, 이게 적은데도 수치가 높은건 일상적인 질문에는 치명적으로 성능이 낮음.