h100이나 블랙웰은 asic이라기보단 범용 행렬연산용 칩아님? llm엔 효율 좆구릴텐데 왜 서로 못사서 지랄인지 모르겠음 쿠다api때문에 쓴다는데 이것만큼 좆같은것도 없다면서 왜 쿠다만 쓰는지도 의문이고
경쟁할만한 NPU가 없쪙
ASIC은 알다시피 범용성이 부족하잖음
아직 범용성이 필요함
그야 쿠다가 존나 빠르니까 ㅇㅇ 상호 호환성도 압도적이고 대부분의 기술은 쿠다 아니면 사용도 못함 어줍잖게 다른 방식 쓴다고 해도 결국 중간에 쿠다 끼워넣어서 구현해야함
기술적해자
실질적인 대안이 없음
너가 아는 딥러닝 머신러닝 라이브러리들이 대부분 쿠다 생태계에서 커서 쿠다로 돌아가니까 - dc App
c++ 못교체하는이유랑 같음 - dc App