그건아님 o1같은 추론계열도 결국 cot임
oai 직원들이 o시리즈도 그냥 llm이래
R1은 그냥 LLM에 정확도 기반 강화학습한게 끝인 모델임 그냥 LLM이야
본문은 r1 zero까지만 맞는거고 r1이나 o1같은 실사용모델은 아닌듯
그건아님 o1같은 추론계열도 결국 cot임
oai 직원들이 o시리즈도 그냥 llm이래
R1은 그냥 LLM에 정확도 기반 강화학습한게 끝인 모델임 그냥 LLM이야
본문은 r1 zero까지만 맞는거고 r1이나 o1같은 실사용모델은 아닌듯