vqGAN - CLIP은 특붕이들은 지겹도록 봤을만한
이 사진(OpenAI의 Dall: E)처럼 텍스트로부터 이미지를 생성해주는 텍스트-이미지 모델이다.
편리하게도 스타일도 정할 수 있고 결과물에 피드백도 가능하다(뭘 제외하라, 뭐뭐하게 만들어라)
"xx 스타일로 만들어봐."
이런 식으로
"시간 소용돌이에 빨려들어가는 빨간 폰 부스 - 150프레임으로 만들어."
이런 식으로
편의상 명령문으로 했는데 명령문 넣어야 하는 건 아님
그럼 아래로 뜨이-따 작가들의 최근 vqGAN + CLIP 작품들을 보자
"Springstone"
"귀여운 올빼미"
"빛의 바다에서의 항해"
"궤도에 오른 전투 함선"
아직은 부족한 부분이 눈에 밟히긴 하지만 지금도
충분히 디지털 아트의 소스나 영감이 될 수 있을 것 같다.
그리고 2-3년 전에 고작 개와 고양이의 얼굴을 구분하는 수준의 Image classification에 사람들이 놀랐던 걸 생각하면 많은 발전을 체감할 정도는 된다.
GAN에 대해 더 알고 싶다면 여기로:
vqGAN + CLIP에 대해 더 알고 싶다면 여기로:
오 ㅋㅋ 나도 해볼래:
대신 컴 사양 ㅈㄴ 좋아야 한대
포스쩐다
빛의 바다.. 좋네
펨코로 퍼가도 되지?
어... 출처 꼭 표기해야하는 규정이면 퍼가지 말고 펨코 규정 상 출처 표기 상관없으면 출처 빼고 올려주셈
ㅇㅋㅇㅋ ㄳㄳ
와미친거같다 진짜
뭔가 실베 갈거같당ㅋㅋ
바로 완성물 퀄리티는 어려워도 영감을 크게 줄 수 있어보인다.. 대단하다 ㄹㅇ
사용은 어캐해봄?
여기 튜토리얼:
https://youtu.be/LM8dil6n5h8