100번 돌렸을 때,
천만번 돌렸을 때,
보다시피 측정값이 stable 하게 가라앉게 된다.
다시 천만번 돌렸을 때,
다시 천만번 돌렸을 때,
조금 무거운쪽이 3클럭 텼지? 오차는 거의 3클럭에 수렴하게 된다. ( 측정 경계라서 그래 )
이게 RDTSC 와 min 값을 이용한 측정의 정확도다.
음하하.
어차피 cached 측정 말곤 별 실효성 없음.
정책이긴 하지만 난 똑같이 cached 인 상황에서 최적화 하는걸 목표로 한다는거지.
최적화가 필요하면 클러스터링과 카테고리별 memory pool 관리가 필수니까.
내가더잘생긴게틀림업다
rdtsc 가 튀면 이런 결과가 나오겠냐? 낄낄. 다 튀는 하드웨어와 아닌 하드웨어가 있단거다. 글구 솔직히 AMD 는 오래 안써서 몰겠고 intel 에서 RDTSC backlash 는 근 10년 동안 본적 없음.
QueryPerformanceCounter 돌리면 그거 돌리는 클럭수가 저 클럭 결과를 훨 상회해버림 ㅋㄷ
한 몇 초?
이건 2KB 전송이라 간단한거니까유
정규분포 추출을 순수수학적으로 모델링하면 좀 무겁쥬. exp 30개 가까이 써야하니
즉, 수없이 많이 돌린 min 을 평균내면 1clock 단위의 측정 정확도 맞출수 있다는 의미 : ) 저 경우는 aligned 가 574 clock 이 되는 셈이지
최소 클럭 셀이 왜 3 clock 단위인진 안찾아봤지만. 뭐 동기화 룰이겠지.
rdtsc 내부 비용에 의한 동기화 : )
포토샵 실력 많이 늘었구나? 대단하네. 합성 실력 이 정도면 ...ㄷㄷ
ㅋㄷ 왜 이거 돌린거 소스 올려줘?
병신 인증하는 애들이 왤케 많냐.