NDEBUG 제대로 걸려 있고
4MB 테스트
1MB 테스트
64KB 테스트
2KB 테스트
얼간이가 또 허수아비 공격 하는구나.
다시 말하지만 니가 인트린직으로 구현한건 모조리 unaligned 인 셈.
걍 분류하기도 그런 하드웨어 가속임.
100회로 돌려서 숫자가 쨈 불었네 10000회로 돌려주랴?
i5, i7, xeon 다 테스트함유~
이건 i5.
AMD 한테는 빅 엿을 두 번 2000년 2005 년에 먹어서 다신 안씀.
2006년이구나. AM2 에서 빅엿 먹은게.
프갤 인기주제인거 같아 잠깐 생각해봤는데 CPU가 지원만 해주다면 빠르다는게 이상한것도 아닌듯 unaligned도 따지고 보면 대가리랑 꼬리만 unaligned이지 몸통은 aligned일테니까 괜히 알고리즘 꼬와놓은거 보다 cpu가 알아서 대가리랑 꼬리 예외처리해주는게 더 빠를수도 있게다는 짐작이 됨 데이타가 크면클수록 더 차이날거 같은 ㅋ 그냥 짐작임
그 이야기를 대강 썼다가, 찬찬히 썼다가, 설명을 몇 번 했는데 못알아쳐먹고 혼자 주장중 ㅋㄷ 그걸 박수치는 애들도 개그.
대가리랑 꼬리 예외 만으로 되는게 아니야 그건 그냥 전체 사이클에서 몇 십 클럭 차이거든.
가운데 반복루틴이 핵심인데, 저렇게 하드웨어 가속 직접 돌려버리면 걍 unaligned 인거라고 ㅋㄷ
다시 말하지만 니가 인트린직으로 구현한건 모조리 unaligned 인 셈.
걍 분류하기도 그런 하드웨어 가속임.
100회로 돌려서 숫자가 쨈 불었네 10000회로 돌려주랴?
i5, i7, xeon 다 테스트함유~
이건 i5.
AMD 한테는 빅 엿을 두 번 2000년 2005 년에 먹어서 다신 안씀.
2006년이구나. AM2 에서 빅엿 먹은게.
프갤 인기주제인거 같아 잠깐 생각해봤는데 CPU가 지원만 해주다면 빠르다는게 이상한것도 아닌듯 unaligned도 따지고 보면 대가리랑 꼬리만 unaligned이지 몸통은 aligned일테니까 괜히 알고리즘 꼬와놓은거 보다 cpu가 알아서 대가리랑 꼬리 예외처리해주는게 더 빠를수도 있게다는 짐작이 됨 데이타가 크면클수록 더 차이날거 같은 ㅋ 그냥 짐작임
그 이야기를 대강 썼다가, 찬찬히 썼다가, 설명을 몇 번 했는데 못알아쳐먹고 혼자 주장중 ㅋㄷ 그걸 박수치는 애들도 개그.
대가리랑 꼬리 예외 만으로 되는게 아니야 그건 그냥 전체 사이클에서 몇 십 클럭 차이거든.
가운데 반복루틴이 핵심인데, 저렇게 하드웨어 가속 직접 돌려버리면 걍 unaligned 인거라고 ㅋㄷ