Cline에서 qwen-corder 2.5 : 32b 로 돌리고 있는 데,
GPU 100% 사용에 메모리도 90% 사용. mac mini가 쩔쩔 끓는다.
처리는 잘 해주는데, 좀만 빨리 실행되면 좋겠네.
역시 하드웨어에 투자하는 게 아니었단 생각이 드네.
그냥 클라우드 AI 쓰는 게 낫겠어.
맥미니 프로 48기가 메모리. 14c cpu, 20c gpu
이 정도 사양으로도 버거워.
좀더 파라미터가 낮은 모델을 쓰면 나을 거 같긴 한데,
그냥 클라우드 AI가 낫긴하지.
qwen3 32b를 일단써보시고 --override-tensor 옵션으로 익스퍼트를 오프로드해서 qwen3 235BA22B도 돌려보시면
235B면 아에 돌아가지도 않을 거 같은 데.
왜 아직도 2.5 쓰는거임??
그래도 코딩 특화 모델이 버젼이 낮아도 코딩에는 적합하지 않음?