펠트스팀 1 포인트. 23일 전
개인적으로 아는 사람은 없지만 정보를 가진 사람을 알고 있습니다. OpenAI가 타임 라인을 가속화하는 것처럼 항상 그렇듯이 상황이 약간 불안정합니다. 이 정보의 신뢰성을 100% 확신할 수는 없지만 사실일 가능성이 전혀 없는 것은 아닙니다.
따라서 OpenAI는 한 번에 하나의 모델만 천천히 개발하는 것이 아니라 여러 모델을 개발하고 있는 것이 분명합니다. 제가 가장 잘 알고 있는 것은 내부적으로 아라키스라는 이름을 가진 모델입니다. 제가 아는 한 이 모델은 텍스트, 이미지, 오디오 및 비디오의 모든 조합을 입력할 수 있는 만능 모델입니다(3D에 대해서는 잘 모르겠지만 3D 모달리티는 지원하지 않는 것 같습니다). 애니-애니 모델이 어떻게 생겼는지 보려면(기능만 다를 뿐 아키텍처는 많이 다릅니다) https://codi-gen.github.io/ 참조) 이러한 양식의 모든 조합을 출력할 수 있습니다(제미니도 이와 비슷할 수 있지만 제미니는 텍스트 + 이미지 + 오디오에 더 중점을 둘 것이라고 생각하지만 비디오도 가능할 수 있으며 오디오에 대해서는 100% 확신하지는 못하지만 가능성이 있다고 생각합니다). 비디오 생성에 관한 한, 훌륭하지는 않지만 현재 SOTA 비디오 생성기로 간주되는 Gen-2보다는 낫습니다. '아라키스'도 GPT-4의 기능을 훨씬 능가하며 AGI에 매우 근접합니다. 많은 부분에서 전문가 수준의 인간에 매우 근접한 성능을 발휘하지만, 안타깝게도 아직 전문가 수준에는 미치지 못합니다. 환각률은 완전히 사라지지는 않았지만 GPT-4보다 훨씬 낮습니다. 훈련된 데이터의 절반이 합성 데이터라는 사실에 놀랐지만 합성 데이터가 확실히 유용하다는 것을 보여줍니다. 솔직히 GPT-4가 약간이라도 의식이 있었다면 이 모델에 대해 윤리적인 이야기가 많이 나왔을 텐데, 알트먼은 이 모델이 실제로 의식이 있을 가능성이 있더라도 사람들이 그냥 하나의 도구로 봐주길 바랐을 것입니다. 이 사람은 GPT-4보다 추론 패스 당 활성화되는 매개 변수가 적기 때문에 추론 비용이 실제로 GPT-4와 거의 같거나 약간 낮다고 말했지만, 확실히 매개 변수가 훨씬 더 많기 때문에 여전히 믿기 어렵지만 누가 알겠습니까? 출시일과 관련해서는 원래 2024년에 출시할 계획이 없었지만, 일정이 앞당겨진 만큼 2024년 중 출시될 가능성도 충분히 있다고 생각합니다. ChatGPT/GPT-4의 출시로 무엇이 가능한지 보여줬고 이제 사람들이 천천히 따라잡고 있기 때문에 모든 사람들이 AI 개발에 박차를 가하고 있기 때문에 상황이 복잡합니다. 그리고 이 모델도 아주 아주 좋은 자율 에이전트입니다. 이 모델이 출시되면 어떻게 작동할지 모르겠습니다. 비디오, 오디오 및 이미지 업로드에 대한 액세스를 비활성화하고 GPT-4에서 이미지 입력이 활성화된 상태에서 바로 출시하지 않은 것처럼 이러한 양식을 천천히 출시할 수도 있고, 이미지와 오디오 또는 모든 것을 바로 출시할 수도 있습니다. 그리고 OpenAI는 AI가 '의식적'인 것으로 간주되면 판매하기가 훨씬 더 어려워지고 이는 그들에게 해가 될 것이기 때문에 가능한 한 도구처럼 보이도록 노력할 것입니다. 또한 제가 알기로는 이 모든 것은 현재 정보를 기반으로 한 것이며, 이 모델은 이미 존재합니다. OpenAI가 어떤 계획을 세운 것이 아니라 그들이 이미 해낸 것입니다.
개인적으로 아는 사람은 없지만 정보를 가진 사람을 알고 있습니다. OpenAI가 타임 라인을 가속화하는 것처럼 항상 그렇듯이 상황이 약간 불안정합니다. 이 정보의 신뢰성을 100% 확신할 수는 없지만 사실일 가능성이 전혀 없는 것은 아닙니다.
따라서 OpenAI는 한 번에 하나의 모델만 천천히 개발하는 것이 아니라 여러 모델을 개발하고 있는 것이 분명합니다. 제가 가장 잘 알고 있는 것은 내부적으로 아라키스라는 이름을 가진 모델입니다. 제가 아는 한 이 모델은 텍스트, 이미지, 오디오 및 비디오의 모든 조합을 입력할 수 있는 만능 모델입니다(3D에 대해서는 잘 모르겠지만 3D 모달리티는 지원하지 않는 것 같습니다). 애니-애니 모델이 어떻게 생겼는지 보려면(기능만 다를 뿐 아키텍처는 많이 다릅니다) https://codi-gen.github.io/ 참조) 이러한 양식의 모든 조합을 출력할 수 있습니다(제미니도 이와 비슷할 수 있지만 제미니는 텍스트 + 이미지 + 오디오에 더 중점을 둘 것이라고 생각하지만 비디오도 가능할 수 있으며 오디오에 대해서는 100% 확신하지는 못하지만 가능성이 있다고 생각합니다). 비디오 생성에 관한 한, 훌륭하지는 않지만 현재 SOTA 비디오 생성기로 간주되는 Gen-2보다는 낫습니다. '아라키스'도 GPT-4의 기능을 훨씬 능가하며 AGI에 매우 근접합니다. 많은 부분에서 전문가 수준의 인간에 매우 근접한 성능을 발휘하지만, 안타깝게도 아직 전문가 수준에는 미치지 못합니다. 환각률은 완전히 사라지지는 않았지만 GPT-4보다 훨씬 낮습니다. 훈련된 데이터의 절반이 합성 데이터라는 사실에 놀랐지만 합성 데이터가 확실히 유용하다는 것을 보여줍니다. 솔직히 GPT-4가 약간이라도 의식이 있었다면 이 모델에 대해 윤리적인 이야기가 많이 나왔을 텐데, 알트먼은 이 모델이 실제로 의식이 있을 가능성이 있더라도 사람들이 그냥 하나의 도구로 봐주길 바랐을 것입니다. 이 사람은 GPT-4보다 추론 패스 당 활성화되는 매개 변수가 적기 때문에 추론 비용이 실제로 GPT-4와 거의 같거나 약간 낮다고 말했지만, 확실히 매개 변수가 훨씬 더 많기 때문에 여전히 믿기 어렵지만 누가 알겠습니까? 출시일과 관련해서는 원래 2024년에 출시할 계획이 없었지만, 일정이 앞당겨진 만큼 2024년 중 출시될 가능성도 충분히 있다고 생각합니다. ChatGPT/GPT-4의 출시로 무엇이 가능한지 보여줬고 이제 사람들이 천천히 따라잡고 있기 때문에 모든 사람들이 AI 개발에 박차를 가하고 있기 때문에 상황이 복잡합니다. 그리고 이 모델도 아주 아주 좋은 자율 에이전트입니다. 이 모델이 출시되면 어떻게 작동할지 모르겠습니다. 비디오, 오디오 및 이미지 업로드에 대한 액세스를 비활성화하고 GPT-4에서 이미지 입력이 활성화된 상태에서 바로 출시하지 않은 것처럼 이러한 양식을 천천히 출시할 수도 있고, 이미지와 오디오 또는 모든 것을 바로 출시할 수도 있습니다. 그리고 OpenAI는 AI가 '의식적'인 것으로 간주되면 판매하기가 훨씬 더 어려워지고 이는 그들에게 해가 될 것이기 때문에 가능한 한 도구처럼 보이도록 노력할 것입니다. 또한 제가 알기로는 이 모든 것은 현재 정보를 기반으로 한 것이며, 이 모델은 이미 존재합니다. OpenAI가 어떤 계획을 세운 것이 아니라 그들이 이미 해낸 것입니다.
선갤은어디냐?
선형주의갤
와 역사상 최초의 AGI 이름 메모... '아라키스'
제미니 싹다 구속시켜
쟤는 또 누구임? 신뢰할만한 전적이 있음?