vqGAN - CLIP은 특붕이들은 지겹도록 봤을만한


이 사진(OpenAI의 Dall: E)처럼 텍스트로부터 이미지를 생성해주는 텍스트-이미지 모델이다.

편리하게도 스타일도 정할 수 있고 결과물에 피드백도 가능하다(뭘 제외하라, 뭐뭐하게 만들어라)

"xx 스타일로 만들어봐."

이런 식으로

"시간 소용돌이에 빨려들어가는 빨간 폰 부스 - 150프레임으로 만들어."

이런 식으로

편의상 명령문으로 했는데 명령문 넣어야 하는 건 아님





그럼 아래로 뜨이-따 작가들의 최근 vqGAN + CLIP 작품들을 보자

"Springstone"


"귀여운 올빼미"


"빛의 바다에서의 항해"


"궤도에 오른 전투 함선"


아직은 부족한 부분이 눈에 밟히긴 하지만 지금도
충분히 디지털 아트의 소스나 영감이 될 수 있을 것 같다.

그리고 2-3년 전에 고작 개와 고양이의 얼굴을 구분하는 수준의 Image classification에 사람들이 놀랐던 걸 생각하면 많은 발전을 체감할 정도는 된다.

GAN에 대해 더 알고 싶다면 여기로:

vqGAN + CLIP에 대해 더 알고 싶다면 여기로:

오 ㅋㅋ 나도 해볼래:

대신 컴 사양 ㅈㄴ 좋아야 한대