2015년경 내가 처음으로 이미지 캡셔닝(이미지에서 텍스트로) 네트워크를 보여줬을 때 페이페이가 내게 했던 말: "정말 멋져, 이제 거꾸로 해봐!"
나: "하하 그건 불가능해요" 알고 보니 ~B 규모의 대체 텍스트 데이터셋 스크랩, 트랜스포머, 디퓨전, 그리고 ~1천 개의 A100 클러스터만 있으면 된다는 걸 알게 됐어.
2015년경 내가 처음으로 이미지 캡셔닝(이미지에서 텍스트로) 네트워크를 보여줬을 때 페이페이가 내게 했던 말: "정말 멋져, 이제 거꾸로 해봐!"
나: "하하 그건 불가능해요" 알고 보니 ~B 규모의 대체 텍스트 데이터셋 스크랩, 트랜스포머, 디퓨전, 그리고 ~1천 개의 A100 클러스터만 있으면 된다는 걸 알게 됐어.
하하 AGI는 불가능해요
안된다면 스케일이 부족한거다
페이페이리 논문 저자 중 있던데 이런 사람이었구나 ㄷㄷ
너무 많은게 필요하노ㅋㅋㅋ
카파시 논문 보면서 캡셔닝 따라하던게 엊그제 같은데 벌써 8년이나 지났네 ㅋㅋ