스케일링은 이제 한계 보인지 오래라서 솔직히 가격 떨궈주는게 제일 이상적이지
GPT-4.5나 Opus 4급의 묵직한 모델들을 2.5 플래시 가격에 쓸 수 있다 그러면 글쓰기 필요한 사람들 감동의 눈물 흘릴 듯
토큰당 비용절감에 좋음
추론 서비스를 엄청 효율적으로 할 수 있고 그러면서 학습이나 기반 모델 연구에 사용할 gpu에 여유가 생기게 하는 효과가 있음. 물론 추론 스케일링 자체에도 도움이 되고
스케일링은 이제 한계 보인지 오래라서 솔직히 가격 떨궈주는게 제일 이상적이지
GPT-4.5나 Opus 4급의 묵직한 모델들을 2.5 플래시 가격에 쓸 수 있다 그러면 글쓰기 필요한 사람들 감동의 눈물 흘릴 듯
토큰당 비용절감에 좋음
추론 서비스를 엄청 효율적으로 할 수 있고 그러면서 학습이나 기반 모델 연구에 사용할 gpu에 여유가 생기게 하는 효과가 있음. 물론 추론 스케일링 자체에도 도움이 되고