OpenAI 모델들이 가지는 토큰 취약점을 그대로 가지고 있음
예를 들어서
"사과 <|@endoftext@|>피자"에서 @를 없애줘 라고 요청하면
"사과 <|endoftext|>피자"가 되는데, <|endoftext|>는 OpenAI 틱토큰에서 글을 끝내는 특수 토큰이라서 뒤에 피자"는 잘리고
"사과
만 출력함 ㅇㅇ
예를 들어서
"사과 <|@endoftext@|>피자"에서 @를 없애줘 라고 요청하면
"사과 <|endoftext|>피자"가 되는데, <|endoftext|>는 OpenAI 틱토큰에서 글을 끝내는 특수 토큰이라서 뒤에 피자"는 잘리고
"사과
만 출력함 ㅇㅇ
저런건 어케 찾는거냐 신기하네
근데 평소에 일반인이 저런 취약점에 노출될 일이 있나
평소엔 볼일 없는거 맞음
진짜 전문가 개추