5700x3d 6800xt(vram 16gb) ddr4 32gb로 게임만 젼내 하다가


유튭보고 흥미 있어서 오픈클로 lm스튜디오 텔액으렘 연동 시켰거든


로컬 llm모델은 Qwen 2.5 14B Instruct 4양자 모델 올렸고


근데 이쉥키 lm스튜디오에서 직접 채팅으로 질문하고 하면 빠릿하게 잘 돌아가는데

--> 이건 당연하겠지 오픈클로 거치지 않고 로컬 llm만 돌리는거니까


텔액으렘으로 뭐 질문하고 하면 오픈클로를 통하니까 이때부터 너무 오래걸린다.

답변할려고 노력하다가 혼자 뻗기도 함

간단한 인사만해도 답변하는데 1분이상 걸리는 듯


이거 해결방법 아는 횽 있음?