Gpu 컨퍼런스 매년 국내껀 다 다니는 내 관점에서 보면
성능치만 말해줌
플랫폼 종속적인 빌트인 API
에서 1테라 플롭스 나오면
OpenACC 50메가 플롭스나옴
Cuda나 OpenCL 최적화 상당히 해봤자 500 메가플롭스
nvidia 장비에 OpenCL 물리면 한..5~10% 정도 차이
음.. 그냥 그래
산업계 Cuda, 과학계 OpenCL 쪽으로 완전히 한쪽이 정복할것
C랑 포트란 차이처럼
Cuda는 라이브러리 지원이 좀 괜찮고
OpenCL은 리눅스 지원이랑 OpenGL 합처서 시각화가 좋음
결론 : OpenAcc 진짜 너무 느림 ㅋㅋㅋ 노답..
cuBLAS 기준임
그렇군여