lmstudio 같은거 쓰면 큰 모델도 일부 램으로 오프로딩해서 쓸수있던데 속도 차이많이나나
[일반] 근데 맥 통합메모리랑 ram 오프로딩이랑 차이 많이남?
댕댕충(nyannyanchung)
2026-02-04 10:19
추천 0
댓글 3
다른 게시글
-
제미나이 왼쪽 채팅 목록 시간지나면 왜 없어지지 [4][일반] 실바나스윈..(inventor9268) | 02.04추천 0
-
특이점 기다린지 7년 세상은 아무것도 바뀐게 없었네 [5][일반] 맘바멘탈리..(hunting7464) | 02.04추천 1
-
오픈AI가 앤트로픽 출신을 Preparedness 담당으로 앉힘[일반] 익명(compact5711) | 02.04추천 2
-
클로드는 하루에 한 두번은 먹통 무한 로딩은 국룰 임.[일반] 익명(182.209) | 02.04추천 0
-
지속학습은 언제나오는데?[일반] 익명(121.144) | 02.04추천 0
-
근데 40%가 뭔가 체감이 안되는데.. [4][일반] 익명(119.192) | 02.04추천 0
-
현재 아이폰 iOS 챗지피티는 mathml 안됨[일반] M3(country1602) | 02.04추천 0
-
오늘 소넷5 출시는 걍 개소리였던건가 [1][일반] 댕댕충(nyannyanchung) | 02.04추천 1
-
속도 40퍼 향상 계속 읽어보니 걍 코드를 최적화했나보네[일반] 익명(sudden9813) | 02.04추천 0
-
Oai 기업용 에이전트는 진짜 얼마만에 떡밥이냐 [1][일반] 익명(1.226) | 02.04추천 0
윈도우기준 너가원하는 크기의 모델을 램로딩하면 1tok/s 나오면 잘나오는거, 맥은 통합이라 상대적으로 잘나오는데 이것도 일반 워크스테이션용 gpu대비 메모리 대역폭이 낮아서 m2ultra 이상 쓰지않을꺼면 100B+ 돌리면 5tok/s 나오고 그럼 맥미니에서 30B이상 쓰기 어려운 이유임 대역폭이 낮음
통합메모리 구조(맥, AI Max 395+ 같은)는 메모리 대역폭을 그대로 iGPU에서 활용할 수 있음 (대략 200-250gb/s)근데 그런 통합구조가 아닌 경우는 메모리 대역폭이 높아도 GPU는 Pcie로 연결된 구조기때문에 pcie 대역폭에 묶임 (4.0 16배속 기준 대략 31.5gb/s) 따라서 대역폭이 중요한 작업 (prefill 같은)에서는 차이가 큼
생각보다 차이많이나나보넹