4,000,000 개의 int array를 동일한 reduction 로직으로 더했을 때,
8800 GTX가 8 ms 정도,
GT 740이 24 ms 정도 걸렸음 -_-
8800 GTX 스펙이 이렇고
스트림 프로세서 128개
코어 클럭 575 MHz
메모리 클럭 900 MHz
메모리 인터페이스 384-bit
메모리 대역폭 86.4 GB/s
GT 740 스펙이..
쿠다 코어 384개
코어클럭 993 MHz
메모리 클럭 1.8 Gbps
메모리 인터페이스 DDR3 128-Bit
메모리 대역폭 28.8 GB/s
뭐 이런데 -_- 속도 차이가 어디서 나는건지 잘 모르겠음 ...
8800 GTX보다 GT 740이 느린 이 상황이 정상적인건지 아닌지 판단이 안됨.
잘못됬다면 뭘 고쳐야되는지 판단이 안되서 ..
싼게 느린데 뭐가 잘못이여
저건 싼게 훨씬 앞서는거 아냐?
그러니까 뭐 때문에 느린지 그걸 평가할 수 있는 가이드라인 같은게 있는가 해서
메모리때문인가?
잘 모르지만, 알고리즘보다 단순 자료입출력이 대부분이면 메모리대역폭영향을 더 많이 받을꺼 같은데요...