그냥 다음에 올 확률로 가장 가능성이 높은 단어 끼워맞추는거 아님?
그럼 무작정 끼워맞추는거니까 아닌걸보고 "아니다"라고 조금이라도 대답할 수 있는 이유가 뭐임?
Gemma 제일 작은모델도 세종대왕 맥북던짐 물어보니까 잘 모른다고 대답하던데
그냥 다음에 올 확률로 가장 가능성이 높은 단어 끼워맞추는거 아님?
그럼 무작정 끼워맞추는거니까 아닌걸보고 "아니다"라고 조금이라도 대답할 수 있는 이유가 뭐임?
Gemma 제일 작은모델도 세종대왕 맥북던짐 물어보니까 잘 모른다고 대답하던데
모른다고 대답하는 데이터를 학습시키면 되지
단순히 모르는걸 대답하는 데이터를 학습한다는게 기준점이 너무 모호하지 않음?
그래서 아직도 환각많잖아