이전 프레임이랑 다음 프레임이랑 거의 똑같은 토큰 일텐데 트랜스포모가 학습 못하라는 법은 없지만 연산량은 엄청 늘어나고 낭비다
[일반] 트랜스포머로 동영상을 학습하는건 낭비다
익명(222.238)
2023-09-20 15:52
추천 0
댓글 10
다른 게시글
-
OpenAI 루머에 대한 레딧붕이의 반응 [5][일반] 빙냥이ㄱㅇ..(6zd2cxvc44h4) | 23.09.20추천 4
-
특이점이 와야한다고 간절히 느끼는 때 [9][일반] 익명(112.171) | 23.09.20추천 3
-
gpt 5나 빨랑 출시해줘[일반] 트루맨(qwer2677) | 23.09.20추천 0
-
agi 응디 감안하면 이정도는 떡을 치겠지? [8][일반] 익명(3e5t8i6y) | 23.09.20추천 0
-
나 잘 이해가 안가는데 [2][일반] 스피(huh44243) | 23.09.20추천 0
-
이제 새로운 분탕메타 생겼노 [2][일반] 익명(aidam3999) | 23.09.20추천 2
-
루머대로 판단하면 아나키스는 agi까지는 아니고 gpt4보다는 훨씬 좋네 [5][일반] 익명(218.154) | 23.09.20추천 0
-
디비휴같은 안드로이드 언제나옴? [6][일반] 투우사(pck2990529) | 23.09.20추천 0
-
오픈 ai 유출자 누군지 알거 같다 [4][일반] 냉참특급(210.223) | 23.09.20추천 0
-
이제 최상위층만 인간답게 살게 되는 거 아닐까 [7][일반] 걍걍귱(124.54) | 23.09.20추천 0
근거는?
트랜스포머가 동영상을 학습한다는 말은 밑도 끝도 없는 소리고 ㅋㅋㅋㅋㅋㅋㅋㅋㅋㅋㅋㅋ
동영상 압축 기술이 괜히 있는게 아님
우리가 사용하는 기본적인 동영상 포맷 압축 방식만 알아도 이런 걱정은 안 할 텐데
동영상 압축기술을 알고는 있었지만 현재까지 동영상 압축기술 트랜스포모에 적용하고 있는 연구는 없는것으로 알고 있다. 넌 네게 중요한 힌트를 줬다
모르면 배우면 되지...
https://co-tracker.github.io/
이런 연구는 있음
오~ 나왔네
언어모델에서는 이전 단어와 다음 단어의 토큰백터가 상당히 다른 경우가 많고 그걸 해석하는 성능이 좋은게 트랜스포머자나. 그런데 동영상에서는 거의 똑같은 토큰 백터들의 나열은 트랜스포머가 많은 연산을 잡아 먹어가면서 해석한다는게 뭔가 비경제적으로 보인다. 동영상 압축에서 쓰이는 델타프레임들은 토큰 백터들의 차이가 크기 때문에 트랜스포머에 더 적합할수도 있다는 생각이 드네
동영상이 이미지인데 VIT는 뭐 사기임?