대형모델 기준으로 O1 -> O3 비용 증가가 너무 큼O4나 O5도 이정도로 증가한다면 서비스하기 힘든데 미니만 서비스한다면 몰라도 근데 미니만 서비스하면 왠지 개짜치잖음.. 풀모델 쓰고싶은데 어쨌든 경량화이슈땜에 full O3 서비스 기약 없는것도 짜증나고O3 서비스할때쯤이면 내부에 O4 있을것 같은데 이거도 경량화땜에 풀모델은 서비스 못할거고.. 경량화만 기다리다 서비스는 하지도못하고 아주 O5 O6 넘버링만 올라가겠네
모델 성능 향상만큼 경량화 속도도 미쳤던데. 크게 걱정할건 아니라고 생각함
문제는 그게 빠르다고 해도 O1 -> O3 넘버링 올라가는 속도만큼 빠르진 않다는거임 난 이게 좀 걸린다
o3 full을 4o급으로 싸게 쓸려면 루빈 gpu 까진 나와야하지 않을까 싶긴함
O3는 뭐 그렇다 쳐도 O4 경량화 생각하면 정신이 아찔해짐 이건 진짜 루빈 기다려야될것 같은데 ㅅㅂㅅㅂ 언제기다려 그걸
GPT3.5도 거의 1년만에 절반으로 줄이고, 4도 1년전까진 거의 못 줄였다고 말했었지만 금방 다 줄여버림. 네가 다소 조급한 것 같당.
1년 "씩이나" 걸린거임 반면 O1 -> O3는 3개월 걸렸고 이게 밸런스가 안맞아서 기대만큼 발전이 빠르지 않다는걸 말하고 싶은거
원래 경량화라는게 다 그런거라서 뭐 근데 이래도 gpt보단 훨씬 빠르다는거임