빌 게이츠 기사에서 댓글단 거 번역해 옴

GPT-2에서 GPT-3으로 100배가 조금 넘었고, 물론 약 10배(GPT-3의 경우 1,750억 개의 파라미터에서 GPT-4의 경우 1.7T로 추정)로 확장하는 것은 그다지 인상적이지는 않지만 창의성, 추론 및 이와 같은 매우 유용한 일반적인 개선이 크게 향상되는 것을 볼 수 있었습니다. 하지만 인간의 시냅스와 동일한 수의 매개변수를 가진 모델을 100T와 같은 규모에 적용했을 때 어떤 결과가 나올지 궁금합니다. 그리고 그 너머도 궁금합니다.

개인적으로 스케일링에서 얻을 수 있는 것이 아직 많다고 생각합니다.