사람도 머리에 총맞고 뇌 절반 날아갔는데도 뇌기능은 정상이었다는 사례가 있음. 이거랑 비슷한 원리라고 본다. 이미 학습이 끝난 모델은 이후 파라미터를 줄여도 성능이 그대로 유지된다는 거임.
[일반] gpt-3.5 파라미터 줄여도 성능 그대로인 이유
익명(211.227)
2023-10-30 21:52
추천 1
댓글 1
다른 게시글
-
헌데 이 기본소득을 반대하는 것도 점차 시간이 흐를 수록 사라지게 될 것[일반] 익명(180.182) | 23.10.30추천 1
-
그냥 미국이 모든 인재 데려가서[일반] 익명(223.38) | 23.10.30추천 1
-
바로 1년만에 노동대체가 가능할까? [2][일반] hk416d(39.117) | 23.10.30추천 1
-
아인슈타인 수준의 인공지능 ㄷㄷ[일반] 익명(116.124) | 23.10.30추천 0
-
미국은 언제쯤 노동 대체될까[일반] 익명(223.38) | 23.10.30추천 0
-
여기 처음엔 완몰가 얘기만 했네 [1][일반] 익명(115.86) | 23.10.30추천 0
-
100배 효율 gpt4 + H100 + 자율에이전트 = ?[일반] 익명(121.158) | 23.10.30추천 1
-
뭔일있음?? [1][일반] 슈퍼130클..(y3xxqs89b55t) | 23.10.30추천 0
-
3.5turbo 파라미터 준 거 그냥 [2][일반] 익명(14.38) | 23.10.30추천 0
-
gpt3.5 turbo 대체 뭔 짓을 한거임? [8][📪정보] 익명(222.108) | 23.10.30추천 22
그 아이디어가 LLM prunning 인데 기존 방법으로 90% 압축은 말이 안돼서... 내부적으로 몇년 앞서있다는게 구라가 아닌듯;