AGI가 꼭 완전 단일 모델이어야할 필요는 없지. 인간처럼 하나의 두개골에 뇌가 들어있어야할 것도 아니니까.
ㄴㄴ 전혀 상관없음 애초에 GPT의 기반이되는 트랜스포머도 1개의 시퀀스에대한 8개의 어텐션출력을 이어붙인 멀티헤드 어텐션이 핵심임 그냥 멀티헤드어텐션을 만들어낸 아이디어를 GPT에게도 적용시켰을뿐임
오히려 해당뉴스는 GPT-4를 따라잡기위한 단서중 하나이자 사이즈업을 어떤식으로 해나가야하는지에 대한 실마리를 제공한거라고 봐도됨 단순히 단일모델을 키우는게아니라 저런식으로 앙상블시키는쪽으로 확장해야 한다는거지 물론 정답은 아니겠지만 일단 아무도 못따라잡고있는 GPT-4에 근접하기위한 유효한 방법중 하나임에는 틀림없음
AGI가 꼭 완전 단일 모델이어야할 필요는 없지. 인간처럼 하나의 두개골에 뇌가 들어있어야할 것도 아니니까.
ㄴㄴ 전혀 상관없음 애초에 GPT의 기반이되는 트랜스포머도 1개의 시퀀스에대한 8개의 어텐션출력을 이어붙인 멀티헤드 어텐션이 핵심임 그냥 멀티헤드어텐션을 만들어낸 아이디어를 GPT에게도 적용시켰을뿐임
오히려 해당뉴스는 GPT-4를 따라잡기위한 단서중 하나이자 사이즈업을 어떤식으로 해나가야하는지에 대한 실마리를 제공한거라고 봐도됨 단순히 단일모델을 키우는게아니라 저런식으로 앙상블시키는쪽으로 확장해야 한다는거지 물론 정답은 아니겠지만 일단 아무도 못따라잡고있는 GPT-4에 근접하기위한 유효한 방법중 하나임에는 틀림없음