그사이 노선 변경한 알트먼이 새 알고리즘 기반 AI 먼저 내놓을거임
그러니까 얀르쿤에게 기회는 없음
얀르쿤이 10년 말했으니 실제론 15년 이상 걸리고 10년 뒤쯤 다른애가 획기적인 AI 내놓을듯
LLM으론 지피티4가 사실상 한계야. 5 나와도 감동은 없어 4o는 그냥 멀티모달도 지피티 3.5 텍스트수준 정도는 해준다 이정도 어필한거에 불과하고
AGI는 찍먹 수준도 못왔음. 얀르쿤은 안타까운게 비판력, 직관력은 날카로운데 너무 범재, 둔재 스타일임. 뇌가 빠릿하지가 못함. 이런 연구자들이 컨셉츄얼한 띵크는 잘하는데 손에 잡히는 결과물은 잘 못내놓음
그러니까 얀르쿤에게 기회는 없음
얀르쿤이 10년 말했으니 실제론 15년 이상 걸리고 10년 뒤쯤 다른애가 획기적인 AI 내놓을듯
LLM으론 지피티4가 사실상 한계야. 5 나와도 감동은 없어 4o는 그냥 멀티모달도 지피티 3.5 텍스트수준 정도는 해준다 이정도 어필한거에 불과하고
AGI는 찍먹 수준도 못왔음. 얀르쿤은 안타까운게 비판력, 직관력은 날카로운데 너무 범재, 둔재 스타일임. 뇌가 빠릿하지가 못함. 이런 연구자들이 컨셉츄얼한 띵크는 잘하는데 손에 잡히는 결과물은 잘 못내놓음
4o 가 어떻게 3.5 텍스트 수준이라는거지 실사용해봐도 gpt4 보다 근소하지만 더 우위에 있는데 그리고 현재 API로 뿌려둔 4o 가 현재 텍스트만 지원하지만 실제론 단일신경망 내에서 작동하는 멀티모달임 1차원적인 파이프라인이 아니라 '단일' 신경망 이라는거임 이것만 해도 현재 "새 알고리즘 기반 AI" 라고 말할 수 있지않나
레퍼런스 논문이 뭐임? 그냥 순수하게 궁금해서 읽어볼라고
https://openai.com/index/hello-gpt-4o/
가서 읽어보셈
이미지 , 텍스트 , 음성 모든 데이터를 단 하나의 공간안에서 연산할 수 있게끔 단일한 토큰화에 성공했고 그리고 디퓨전 모델의 가장 최약점이라고 지적당해왔던 일관성문제가 해결되고있음
"노선 변경한 알트먼이 새 알고리즘 기반 AI" <-- 이게 이거라고 단일신경망 이거 센세이션이라고 미친거임
오 그래서 시연 영상들이 놀라웠나 보네
현재 openai 가 디퓨전 모델을 다루고 있는 Dall - e 랑 기업제휴가 되어있는데 아마 Dall - e 측에서 방대할정도의 이미지 데이터셋을 받아두었을거임 그리고 OPENAI 가 가지고 있는 비전모델의 이미지 인식능력이 타의추종을 불허할정도로 뛰어나서 하나의 이미지 에서 뽑아낼 수 있는 토큰가중치도 어마어마할거고
나 이거 수십년지나도 못할줄알았는데 해냈다고 내가 이나이에 이거본게 존나 신기함 AGI 는 커녕 반쪽짜리 LLM 이랑 고장난 두뇌 디퓨전으로 만족하고있던와중에 말도안되는게 나와버린거임
그리고 이 미친기술을 지금 나사빠진 특갤러들이 떡밥을 안굴리고있음
지니게이 웩갤에서 똥글싸는거 보다 이거보니 다시보이노
웩갤도 갤러리 특성과 주제에 맞춰서 내가 잘 다뤄줬다고 생각했는데 ㅋㅋ 지능떡밥도 잘굴려줬고
특갤에선 특갤떡밥굴리는거고 웩갤에선 지능떡밥굴리는거고 집단의 주제에 맞춰서 잘굴려주는거지 똥글은 아니라고 생각함
일관성 해결되는거 확실하긴함?
이젠 사진이나 그림을 토큰화 시켜서 이해하기 시작했음 궁금하면 가서보셈
근데 왜 언급을 거의 안함? 해결했으면 홍보 ㅈㄴ할텐데
사만다 의 형식을 차용해서 홍보하고 있잖슴
그리고 우리 일관성 문제 해결함 이러한 느낌의 다분히 학술적인 감각으로 접근해버리면 공부 안한 일반인들은 ? 띄우고 말아버림 마케팅의 가장 중요한점은 바로 시각적인 직관성인데 그렇게 다가갈려면 머리를 더 굴려야함 "우리 GPT 만화그림!" 이런식으로
디퓨전 써본 사람들한테는 희소식일텐데 저렇게 언급이 적은게 이상함 어떤 원리로 작동되고 성능이 어는정도인지 말도 안하고
'단일 신경망' 이라는 개념이 홍보가 안되어있고 지금 OPENAI 가 홍보한건 영화 HER 형식을 차용한 사만다임 사만다로는 지금 OPENAI 가 단일 신경망 이라는 되도않는 미친 기술을 개발했다는것을 알리가 없지
OPENAI 가 홈페이지 안에 조용히 띄워둠 그리고 구글도 인피니 어텐션이라고 어텐션내에 이전어텐션 저장하는 기술 개발했는데에도 지금 아는사람이 협소함
그리고 내가 미친듯이 굴려주고 있는데 나사빠진 특갤러들은 안중에도 없음
지금까지 일관성 해결했다고 나온것들 전부 ㅎㅌㅊ였는데 믿을만하냐 사이트에 사진 몇장 말고 어느정도 성능인지 알 방법 없음?
저게다임
저거 기존 로라같은거랑 전혀다른 작동방식 맞음? 아니면 유사함?
ㄴㄴ 로라아님 그런 구시대적인거아님
지능이 높은사람은 아닌거 같은데 자 내가 더 설명하기 귀찮으니까 한문장으로 설명함 딱 읽고 딱알아들으셈 너가 원하는 캐릭터 레퍼런스 몇개 넣어두고 "이 캐릭터의 모습을 그대로 참고해서 도로위에서 뛰어다니는 장면을 그려줘 근처 배경에는 뛰어다니는 캐릭터를 보고 놀라는 사람들이 있었으면 좋겠어 그리고 그림체를 통일해줘" 라고 하면 그대로 문장을 '이해' 해서 그림을 뿌려줌
그리고 저렇게 그려준걸 기반해서 다시 부탁하는거지 "캐릭터가 넘어졌으면 좋겠어 그리고 그냥 넘어지는게 아니라 와장창 넘어져서 구도의 역동성을 더해줬으면 좋겠어 그리고 바닥에 넘어지는게 아니라 사람위로 넘어지는걸 그려줘" 이렇게 부탁할수도있음
그 다음 "캐릭터가 일어난뒤에 넘어진 사람을 상대로 머리를 긁적이며 사과하는걸 그려줘" 라고 하면 그걸 그러줌 왜냐 이전에 이 인공지능 모델이 그렸던걸 다시 토큰화 해서 이해하고있기때문임
그리고 더 극단적으로 가면 그림 한장에 그림에 맞는 대사 하나에 대사에 맞는 음성을 입힐 수 도 있음 이건 데이터베이스가 많아야겠지?
이해력도 설명도 ㅎㅌㅊ네 그걸 어떻게 하는지 구체적인 논문같은게 있는지,성능이 어느정도 인지 물어보는데 무슨 뛰고 넘어지고 ㅇㅈㄹ
이 댓글보던 사람이다 이해력은 니가 좆딸리는거고 이씨발 ㅇㅇ새끼야 지니님이 존나 설명잘하는거임 애미터진 씨발새기야
애미애비 둘다 터져버린 지능낮은 원숭이새끼가 야지나 쳐주고있네 고맙다고 못할망정
캐릭 레퍼 몇개 넣고 하는건 로라랑 똑같은데 뭐 4o는 "이해"하고있다 어쩐다 말고 예시들도 단순한 거 보면 기대가 엄청나진 않은데 일단 수고함
와 애미 털린새끼는ㅋㅋ 이대화에서 지가 갑인거마냥 씨발새끼가ㅋㅋ
지니야 너가 먼저 "지능이 높은사람은 아닌거 같은데" 이런 쓸데없는 소리 했쟎냐 꼭 통피로 분풀이할 필요는 없다고 본다
니가 수고했느니 마느니 씨발새끼가 아랫사람대하냐? 애미 털려서 고아인새끼야? 너솔직하게말해 평소에 현실에서 존중 못받고살지?
먼저 그런 말 했으니 지렁이도 밟으면 꿈틀거린다고 상대가 예민하게 반응하는것도 당연한거 아니겠니 슬슬 로그인 해라
동일인 아님 다중이로 묶지마셈 설명해줄거 다해주고 레퍼런스까지 다 가져다줬는데 로라소리 나오는건 맞다고보냐?? 개씨발새끼가
현실이었으면 난도질당했을거다 씨발새끼야
뭐여 설명해두고 딴거하다왔는데 시비털어놨네 뒤질래?
쭉 다 읽어봤는데 유익하고 잼있네 ㅋㅋㅋ 도대체 왜 별거 아닌걸로 서로 신경긁구 싸우는거얌 ㅋㅋㅋ
지니 그림자분신술 ㄷㄷ
일관성 해결은 진짜 큰거 왔네 ㅋㅋㅋ