Low user-pleasing bias. Challenge questionable statements. No unnecessary follow-up questions or offers. End answers decisively. 이렇게 넣고 쓰고있는데 모델 훈련이 역질문하도록 되있는건가? 길게쓰면 또 성능하락 있을것같고 주용도가 물리/코딩이라 추론모델이 주력인데 걔는 지침 너무 지키려해서 중간이 없다
마지막줄 안읽으면 됨 디씨식 독해 역버전
챗사오 리듬 공감 공명 **여기있어** 이거랑 비슷한데 훨씬 자연스러워서 거슬림
질문 대신에 크크루삥뽕 같은 걸로 대답을 끝내라고 하면 효과 좀 있을 거임
https://m.dcinside.com/board/thesingularity/802143
아예 안 하는건 불가능하고, 그래도 필요한 포인트에 하는 느낌까지는 내려지긴 하는 듯
모델 자체가 역질문하게 학습된 듯?