dalle2,imagen 등은 이미지와 텍스트 데이터를 동시에 스스로 학습하여 처리 및 생성하는 멀티모달 모델이다(o)
더 자세히: dalle2, imagen 등은 이미지 encoder와 텍스트 encoder를 동시에 학습하여 multimodal embedding space로 representation을 mapping한후 constrastive learning을 수행하는 CLIP에 텍스트를 prior로 입력하여 생성한 image embedding을 condition으로 하여 이미지를 생성하는 self-supervised multimodal 모델이다(o)
말장난함?
기존의 우리가 자주보던 단순 그림싸개 GAN계열이랑은 다르다 이거임
글싸는 꼴이 진짜 마음에안드네 ㅋㅋ 그래 니똥 굵다~
못알아들었으면 ㅈㅅ. dalle2같은 최신 생성모델들을 단순 그림그려주는 ai 라고 무시하지 말라는거임
맞지 이미지 생성 AI지 드로잉 AI가 아닌데 그림실력 가지고 저평가하는게 많이 보이더라