o1 프로 모드는 형편없습니다.


이 쓰레기에 $200를 지불할 생각이라면, 제발 그러지 마세요. 출력을 만드는 데 터무니없이 오랜 시간이 걸리는데, 결과는 o1보다 약간 나은 수준에 불과합니다.

수학 관련 작업을 한다면, 그래도 괜찮을지도 모릅니다.

하지만 프로그래밍의 경우, 저는 진심으로 4o가 더 나은 선택이라고 생각합니다 (시간 대비 가치가 있다는 의미에서).
LLM으로 코딩할 때는 더 빠르게 반복 작업을 해야 하는데, o1 모델들 (특히 프로 모드)은 너무 오래 걸립니다.

정말 실망스럽습니다.

OpenAI의 새로운 전략은 벤치마크에서 모델이 좋아 보이게 만드는 것 같지만, 실제 현실에서의 실용적인 가치는 그들이 주장하는 것과 맞지 않습니다.

이건 AI 아마추어의 의견이니, 염두에 두고 읽어주세요. 하지만 이 "추론 모델"들은 벤치마크에 과적합된 사용 불가능한 모델을 마케팅 기믹으로 포장하려는 시도일 뿐입니다.

지금까지 제가 본 추론의 유일한 유효한 사용 사례는 정렬(alignment)입니다. 모델이 사용자가 그것을 방해하려는지 생각할 수 있도록 몇 가지 토큰을 제공받는 경우죠.

그런데 혹시 o1 프로 요청이 있으면 알려주세요. 제가 해드릴게요. 사용 한도에 도달하지도 못하고 있는데, 그 이유는 그다지 사용할 만하지 않기 때문입니다.