Deep Think 모드 최대한 활용하기
올해 결과를 달성하기 위해 우리는 Gemini Deep Think의 고도화된 버전을 사용했습니다. 이는 병렬 사고를 포함한 우리의 최신 연구 기법들을 통합한, 복잡한 문제를 위한 향상된 추론 모드입니다. 이 설정을 통해 모델은 단일하고 선형적인 사고의 연쇄를 추구하는 대신, 최종 답변을 제시하기 전에 여러 가능한 해결책을 동시에 탐색하고 결합할 수 있습니다.
Deep Think의 추론 능력을 최대한 활용하기 위해, 우리는 추가적으로 이 버전의 Gemini를 다단계 추론, 문제 해결, 그리고 정리 증명 데이터를 더 많이 활용할 수 있는 새로운 강화학습 기법으로 훈련시켰습니다. 또한 Gemini에게 수학 문제의 고품질 해결책으로 구성된 선별된 말뭉치에 대한 접근 권한을 제공하고, IMO 문제에 접근하는 방법에 대한 일반적인 힌트와 팁을 지침에 추가했습니다.
우리는 이 Deep Think 모델의 버전을 Google AI Ultra 구독자들에게 출시하기 전에 수학자들을 포함한 신뢰할 수 있는 테스터들에게 먼저 제공할 예정입니다.
병렬 사고(추론)과 새로운 강화학습 기법이 주요한 듯
(수학 데이터를 컨텍스트로 줬는데, 안 줘도 금메달이라고 함)
지침이야 뭐 차근차근 풀어보세요 이런 정도인 듯
누가 구글이 한국 대학에서 수학 데이터 잔뜩 긁어간다는데 실제로 데이터 기여자 목록에 한국인들이 잔뜩임
해당 댓글은 삭제되었습니다.
오픈AI랑 독립적으로 같은걸 발견했는지, 다른건지 궁금해지네
그냥 한국수학이네
제미나이 딥씽크 속의 한국인(데이터)
수학 문제의 고품질 해결책으로 구성된 선별된 말뭉치 << 이건 좀 실망인데
그건 또 그렇긴 해
킹 국
스읍 근데 그럼 도구 쓴거잖아 오픈ai가 아직 우위에 잇는거네
진짜 모델 단독 깡으로 푼거는 대단한 듯
Ciprian Manolescu가 IMO 3번 만점받은 유일한 인물