지금 테스트 하고 있는 프로그램이 gt 740의 쿠다를 전부 다 쓰고 있는게 아니긴 하지만
740은 좀 넘한거 같아서 -_- 쿼드로 살 돈은 없고 그냥 970이나 가볼까 싶은데 ...
컴알못이라 어떤 점에서 속도 차이가 발생할 수 있는건지 모르겠음.
일단 프로그램 로직을 보면, 크게 세부분으로 나눠지는데 ...
1. 계산할 값을 디바이스로 복사
2. 계산 수행
3. 결과값을 호스트로 다시 복사
속도 측정해보면 복붙하는건 사실 전체에서 20% 정도 시간을 소모하는거고 계산 과정에서 차이로 보이는데
gt 740의 베이스 클럭이 993 MHz, 970이 1050 MHz 로 의미있는 차이는 아닌거 같아서 고민됨...
메모리 대역폭은 740이 28.8 GB/s 970이 224 GB/s로 매우 큰 차이가 있긴한데, 이게 호스트-디바이스간 데이터 전송 속도라면
로직 개선이 없이는 돈지랄로 개선할 수 있는 속도 차이가 크지 않은걸로 보임
이렇게 보는게 맞나?
세줄 요약
1. 쿠다로 시뮬레이션 꿀 빨고 싶음.
2. 호스트-디바이스 전송 시간보단 계산에서 소모되는 시간이 많이 큼.
3. GT 740과 GTX 970의 계산 속도 차이가 나는지?
씨* 740 나부랭이로 쿠다 뭐시기를 운운하다니, 감속기급
그래도 cpu보단 빠름;;;
최소 3배 이상 차이 날듯
뭐 땜에 그렇게 됨? 눈뜬 봉사라 스펙시트를 봐도 잘 모르겠음 ㅠ.ㅠ
계산유닛이 비싼게 더 많은걸로 알고있습니다. gpu는 대개 단순한 계산의 병렬프로그래밍에 쓰이는 물건이니 클럭도 봐야겠지만 계산유닛(쿠다유닛이던가..)이 더 많은게 장땡일듯 싶습니다.
그리고 메모리 대역폭은 그래픽카드메모리 말하는것 아닐까 싶은데 잘 모르겠네요.
gt420이랑 gtx750이랑 쿠다는 아니고 다이렉트x계산셰이더 만질 기회가 있어서 써봤는데 속도차이가 많이 났습니다.
아하! 쓰레드랑 쿠다랑 1:1 이란 식으로 착각했습니당;
계산유닛갯수같은건 아마 하드웨어사이트에 그래픽코어 분석글이나 벤치마크사이트에 있을듯 싶네요
gt 740이 384개, 970이 1664개 허 ㅋㅋㅋ 넘사벽이네요.
야 비교할걸해라. 네이밍부터 x70시리즈랑 x40시리즈를 비교하냐ㅋㅋㅋㅋ 460같은 x60시리즈가 보급형, 970같은 x70이 메인스트림, 980같은 x80시리즈가 하이엔드인데 급자체가 다르지
그런 수준의 얘길원한게 아님 ㅡㅡ 넘사벽이라는 성능차이를 스펙시트의 뭘로 확인할 수 있냐는 걸 물은거임,