1000만 토큰 내에서 이 정도의 일관성과 기억력을 유지하면서 그렇기 때문에 내가 가르친 것들을 잘 따르고 서서히 학습을 한다...?


프로에서 이 정도의 성능을 발휘하는데 파라메터 수를 졸래게 늘린 울트라면 어떤 창발 현상이 일어날지가 너무 궁금함..


아직까지 프로덕션 레벨급, 대기업 컴퓨팅급에서 이런 능력을 가진 LLM이 없었잖아?


이런 능력을 가진 LLM이 Sora 떄와도 같은 스케일 증가에 대한 창발 능력을 갖게 되면 어떻게 될지가 너무 궁금해 미치겠음