종나 빠름
근데 이 새끼가 못하는 말이 없네? 뭐임마?
파딱 하도록
쟤 분명 데갤보고 학습한듯
5090비틱이다죽여라!!!
파딱형에 처한다
@당근빳다죠 ㄴㄴㄴ이건 5090이라 빠른게 아니라 다른 애들보다 쟤가 빠른게 마따
이거보다 똑똑한 qwen3.6 27B 도 Q4_0 + Q8 KV 256K 컨텍스트로 썼을 때 기준 멍청해서 못쓰겠음
걍 LLM 은 GPT 5.6 돈내고 쓰는게 진짜 백만배는 나음
아니면 아예 걍 Gemma4 E2B 이런거 번역기로나 쓰던지해야함 로컬 AI는 딱 그런용도 번역기, 아니면 생성형
qwen 3.6은 너무 느려서 못쓰겠던디.. 나는 일단 속도가 제일 중요함 ㅋㅋ 뭐 성능이야 구독형에 비하면 후달린거야 평생가도 뒤집을 수 없으니 어쩔 수 없는건데 나는 지금도 충분히 킹능성이 느껴짐 gemma 5 존버중
KV Q8로 쓰면 답없음 개인적으로 미니멈은 Q6에 KV캐시 BF16임
@ㅇㅇ ? 벤치마크상 1%도 차이안나
@ㅇㅇ 글고 풀모델 기준도 프론티어보다 한참 떨어지는건 똑같음 걍 나처럼 카쫀쿠 같은거 샀어야함
젠마4 디센스 버전 쓰면은 딥페이크 야동같은것도 생성 가능하냐?
겠냐에요 임마
빠르긴빠르다
ㄹㅇ 속도 하나는 무쳤음
파딱 하도록
쟤 분명 데갤보고 학습한듯
5090비틱이다죽여라!!!
파딱형에 처한다
@당근빳다죠 ㄴㄴㄴ이건 5090이라 빠른게 아니라 다른 애들보다 쟤가 빠른게 마따
이거보다 똑똑한 qwen3.6 27B 도 Q4_0 + Q8 KV 256K 컨텍스트로 썼을 때 기준 멍청해서 못쓰겠음
걍 LLM 은 GPT 5.6 돈내고 쓰는게 진짜 백만배는 나음
아니면 아예 걍 Gemma4 E2B 이런거 번역기로나 쓰던지해야함 로컬 AI는 딱 그런용도 번역기, 아니면 생성형
qwen 3.6은 너무 느려서 못쓰겠던디.. 나는 일단 속도가 제일 중요함 ㅋㅋ 뭐 성능이야 구독형에 비하면 후달린거야 평생가도 뒤집을 수 없으니 어쩔 수 없는건데 나는 지금도 충분히 킹능성이 느껴짐 gemma 5 존버중
KV Q8로 쓰면 답없음 개인적으로 미니멈은 Q6에 KV캐시 BF16임
@ㅇㅇ ? 벤치마크상 1%도 차이안나
@ㅇㅇ 글고 풀모델 기준도 프론티어보다 한참 떨어지는건 똑같음 걍 나처럼 카쫀쿠 같은거 샀어야함
젠마4 디센스 버전 쓰면은 딥페이크 야동같은것도 생성 가능하냐?
겠냐에요 임마
빠르긴빠르다
ㄹㅇ 속도 하나는 무쳤음