위는 어제 kukyakya가 작성한 코드 회사컴 맥프로 ( 인텔 제온 ) 에서 테스트한거


아래는 방금, 쿠캬캬가 새로 올린 코드를 i5 에서 테스트한거


32비트


64비트


정상적인 테스트라면 intrinsic 위주로 된 코드는 32 / 64 비트에서 성능차이가 거의 나지 않는다.

대신 size_t 가 64비트가 되기 때문에 약간의 오버헤드가 생겨 64비트가 느려지는 경우도 있고,

산술 연산에서 64비트 단위가 약간 득을 볼 수 있지만 어쨌든 큰 차이는 없어야 된다는거다.


저새끼가 올린 데이타는 모조리 엉터리고, 일관성도 없고, std:memcpy 성능이 오락가락한다.


니 문제나 똑바로 교차검증하고 올려 이것아. 자꾸 니 문제를 나더러 풀어달라고 하지 말고 등신아.


두 하드웨어에서 돌려본 결과 192000 : 221000 정도로 memcpy 도, unaligned 도 별다른 성능차이 없지?

이게 테스트 환경과 결과의 일관성이란거다.


걍 열심히 계속 삽질해 보거라.