쉽게 설명좀
[일반] 지속학습과 장기기억은 개념적으로 어떻게 다른거야?
익명(sky0204)
2025-12-26 20:43
추천 0
댓글 6
다른 게시글
-
LLM들 존나 씹선형 충인데 [1][일반] 익명(121.168) | 25.12.26추천 0
-
2010년대생이 부러울수도 있겠지만 [2][일반] 익명(121.88) | 25.12.26추천 0
-
한국 현대기아차는 로봇 대체 1순위 아니냐?[일반] 익명(112.185) | 25.12.26추천 0
-
전문가의 바이브코딩 [1][일반] 익명(voter6443) | 25.12.26추천 0
-
겨울이다.. [7][일반] 천상열차(annoy6122) | 25.12.26추천 1
-
안티그래비티 제미나이 프로로 돌리니까 알아서 나노바나나 돌리는거 신기하네 [2][일반] 익명(222.109) | 25.12.26추천 1
-
머스크: 그록이 한국에서 1등을 했습니다. [2][일반] 익명(voter6443) | 25.12.26추천 3
-
시밀러웹 llm 트래픽 변화 [1][일반] 익명(121.190) | 25.12.26추천 0
-
gpt 존나 보수적이네 ㅅㅂ ㅋㅋ [2][일반] 익명(125.134) | 25.12.26추천 0
-
요새 에이전트 쓰면서 agi에 대한 생각[일반] Lily(fraction3193) | 25.12.26추천 0
그게그거아니냐
지속학습 = 들어온 정보들을 망각없이 실시간 가중치 조정으로 모델내에 학습시킴, 장기기억 = 롱 컨텍스트 100만 토큰 1000만 토큰 넘겨도 90퍼센트 토큰 소화력 유지
현재 모델들은 사전학습으로 배운지식만 알고 새로 개념을 가르치는게 불가능. 이걸 해결하는게 지속학습 장기기억은 말그대로 장기기억
LLM 같이 신경망 구조를 가진 인공지능 모델들은 필연적으로 새로운 정보를 학습했을 때, 기존 정보들끼리 연결된 가중치가 달라짐
그래서 새로운 정보를 학습 시킬 때, 기존 정보들의 가중치 개빠그라져서 모델이 병신이 되지 않도록 이빠이 노력을 해야 함. 근데 그 들이는 노력의 수준을 자동화하고 매우 적은 수준으로 들이게 되면
사용자가 사용하면서 입력시키는 정보를 실시간을 학습하는 것이 가능할 것임. 그렇게 되면 입력값이 많아져도 현재 모델처럼 바보 병신이 되지 않을 것이다...