요번에 IMO 금메달 수상한 llm으로 연구 개발 능력이 어느정도 생겼냐 물어보니


본질은 LLM+coT/ToT+강화학습


여전히 데이터 기반 확률 분포 내 최적 탐색기


이게 결론임 ㅅㅂㅋㅋㅋㅋ