텍스트 > 이미지 > 영상으로까지 다중범용성이 확장되었지만
이건 어디까지나 지능의 확장이라기보다 빅데이터를 통해
유사한 이미지를 생성해주는 알고리즘덩어리같은데

멀티모달이 발전할수록 뭔가 agi랑은 무관하다는 느낌이드네