예를 들어서 도시를 표현할 때 자막 표기나 주요 글씨는 잘 나오는데 뒤에 배경이 되는 간판들 글씨가 그냥 개판이더라한글이나 영어를 아무렇게나 쓴 게 아니라 그냥 한글 영어 비슷하게 적어놓은 외게문자여
디퓨전 모델의 한계가 아닐까
영어간판은 비교적 잘 나오지 않나 한글을 이미지나 영상으로 학습을 덜해서 그런가 아닐까
픽셀을 가르쳐서 그럼