기존의 LLM에 막무가내로 집어넣는다는 말은 아님

아예 베이스 모델 학습 단계에서부터 그렇게 활용하도록 만들면 어떨까


'코드 세부사항 편집 반복 요청 시 토큰 최적화'에 대해 생각해보고 있었는데

반복 입력되는 긴 코드만 인식해서 '위 코드 xx라인~xxx라인까지와 동일'에 해당되는 표식으로 대체하려 애쓸 바에야 

차라리 그냥 7z 같은 걸로 프롬프트 전체 내용을 클라이언트가 압축해서 보낸 걸 

모델이 알아먹도록 학습시켜버리는 편이 낫지 않나 싶은 생각이 드네