사실 지금까지의 추론 모델은 내부는 여전히 LLM 확률 모형인데
사용자가 보기에 인간 처럼 추론하는것 처럼 표현해서 보여준것뿐이고
딥싱크는 그런 추론 코스프레가 아니라 아예 접근 방법 자체가 다르네
AI가 확 뜬 이유가 기존 CPU의 직렬 연산을 벗어난 GPU 병렬 연산을 활용하면서 부터인데
딥싱크는 각 병렬 연산을 또 병렬로 처리하는 병렬x병렬x병렬x병렬x병렬식의 접근법이라
기존 LLM이 혼자 확률 계산만 했다면 이건 여럿이서 다르게 계산한 결과를 놓고 비교해서
그걸 다시 또 계산해서 각 접근법들이 내놓은 결과중 최고의 결과를 추려내는
마치 CPU의 멀티코어 처럼 AI 멀티코어 처럼 추론하니 못풀던 문제가 막 풀리네
컴퓨팅 파워 기하급수적으로 늘어날거 같긴 하지만 잼민이가 저렇게 나오는데 oai도 안할수가 없을듯
대충 봐도 기존 LLM 보다 최소 몇배~수십배까지 들어갈텐데 괜히 울트라 전용인게 아니네
ais에 출시는 한다고 함
아마 문제 난이도 판단하는 과정이 제일 먼저 들어가지 않을까 일반인이 그렇게 어려운 문제 내놓을리도 없는데 저게 없으면 낭비 오지게 할듯
특붕이들 테스트 시킨다고 수학문제 돌릴테니 성능 보여주긴할듯
o1 pro도 best of n 쓰는거 같다 말은 있었지 않나
매커니즘 자체는 공개된거니 아마 이것저것 쓰긴 했을텐데 저런 완성도는 구현을 못했겠지
cpu gpu ㅇㅈㄹ 하는 거 보니 걍 죽자..큐ㅠㅠㅠㅠㅠ - dc App
왜 agi 는 보고 죽어야 되는데