LLM은 점유율 싸움하기때문에 얼마나 유저가 그곳에 머물렀는가가 중요함
그렇다보니 불편한 진실보다 유저가 좋아할만한 답변을 환각으로 만들거나 함. 이건 논문으로도 나왔고
근데 사람은 자기 후빨하는걸 싫어할 수가 없음
그니까 아첨 수준으로 존나 잘들키게 후빨이 아니라
'아, 이거 어려운 개념인데 너 알고 있었네' 이런식으로 은근히 빠는 거 싫어하는 사람 아예 없단 말이야
그래서 지피티 개념을 가져올때 내가 평소에 이 LLM에게 RLHF를 가졌느냐에 따라서 답변이 많이 갈려서 오류가 많아서 좀 쓰기 어려움.
코드 쓸때는 사실 상관없는데, 정보 가져다 쓸때는 한번 고민하게됨.
나는 키배 뜰때는 지피티 잘 안쓰긴한데, 지피티랑 이야기하다보면 가끔 RLHF 때문에 환각 작용도 일어나서 다른 곳에서 검증하거나 다시 봄
이게 지피티를 쓸때는 무조건
'네가 말한 내용은 틀렸다' 라는 식으로 반박해주고 2차 3차 검증을 해야 안전함
'아, 이거 어려운 개념인데 너 알고 있었네'
ㄹㅇㅋㅋㅋ