Deep Think 모드 최대한 활용하기

올해 결과를 달성하기 위해 우리는 Gemini Deep Think의 고도화된 버전을 사용했습니다. 이는 병렬 사고를 포함한 우리의 최신 연구 기법들을 통합한, 복잡한 문제를 위한 향상된 추론 모드입니다. 이 설정을 통해 모델은 단일하고 선형적인 사고의 연쇄를 추구하는 대신, 최종 답변을 제시하기 전에 여러 가능한 해결책을 동시에 탐색하고 결합할 수 있습니다.

Deep Think의 추론 능력을 최대한 활용하기 위해, 우리는 추가적으로 이 버전의 Gemini를 다단계 추론, 문제 해결, 그리고 정리 증명 데이터를 더 많이 활용할 수 있는 새로운 강화학습 기법으로 훈련시켰습니다. 또한 Gemini에게 수학 문제의 고품질 해결책으로 구성된 선별된 말뭉치에 대한 접근 권한을 제공하고, IMO 문제에 접근하는 방법에 대한 일반적인 힌트와 팁을 지침에 추가했습니다.

우리는 이 Deep Think 모델의 버전을 Google AI Ultra 구독자들에게 출시하기 전에 수학자들을 포함한 신뢰할 수 있는 테스터들에게 먼저 제공할 예정입니다.

병렬 사고(추론)과 새로운 강화학습 기법이 주요한 듯
(수학 데이터를 컨텍스트로 줬는데, 안 줘도 금메달이라고 함)
지침이야 뭐 차근차근 풀어보세요 이런 정도인 듯

누가 구글이 한국 대학에서 수학 데이터 잔뜩 긁어간다는데 실제로 데이터 기여자 목록에 한국인들이 잔뜩임