추론 하는 과정을 보면 출력에 <think> ~ </think> 이게 추가되고 이걸 파싱해서 추론으로 간주하던데 저번에 추론 모델 데이터셋을 보니까 데이터셋 자체에 추론 내용이 따로 들어가더라고?


그럼 궁금한게 추론모델들은 답변할 때 답변 전에 뭔가 추론 알고리즘이 따로 돌아가는거임 아님 그냥  <think> ~ </think> 이걸 포함해서 더 많이 내뱉도록 학습시킨거임?