찾아보니까
흐릿한 형상에서 원하는 이미지 뽑아내는 식으로 작동하고 기존 데이터 베이스나 인터넷 이미지를 가우시안 블러화랑 원본으로 돌리는방식으로 학습한다는데
달리나 스테이블 디퓨전이나 같은 방법을 사용했는데 왜 차이가 나는지 궁금
달리 미니같은 경우는 ㄹㅇ 인터넷에서 짜집은 이미지 어설프게 합성하는 느낌이었는데
찾아보니까
흐릿한 형상에서 원하는 이미지 뽑아내는 식으로 작동하고 기존 데이터 베이스나 인터넷 이미지를 가우시안 블러화랑 원본으로 돌리는방식으로 학습한다는데
달리나 스테이블 디퓨전이나 같은 방법을 사용했는데 왜 차이가 나는지 궁금
달리 미니같은 경우는 ㄹㅇ 인터넷에서 짜집은 이미지 어설프게 합성하는 느낌이었는데
언어-이미지 CLIP 모델의 성능 차이임