ARC-AGI에 새로운 SOTA(최고 성능) 공개 제출 기록이 나왔습니다:

  • V1: 94.5%, 태스크당 11.4달러

  • V2: 72.9%, 태스크당 38.9달러

GPT 5.2를 기반으로 하는 이 맞춤형 정제(bespoke refinement) 제출물은 @LandJohan이 진행했으며, 여러 접근 방식을 하나로 결합(앙상블)한 것입니다.

---

이게 어떤 방식인가 물어보니까 현존하는 최강의 AI 모델들을 다 불러모아서(앙상블), 답을 바로 찍는 게 아니라 코딩을 시킨 뒤, 채점관 AI가 투표로 정답을 골라내는 방식 이래.
일종의 ai 어벤져스를 구성한 셈이라고 하네.