1. 시작만 aligned 에 맞추면 쭉 aligned 로 처리되면 더할나위 없음 짱 해피.
aligned 가 젤 빠름.
2. src-dst 구조에서는 한쪽을 aligned 에 맞춰도 다른쪽이 unaligned 일 수 있음
즉 불합리한 합성 구조가 필연적임
3. 그걸 하드웨어에서 가속해주면 모두 모두 해피임.
4. 근데 C++로 aligned 를 직접 구현하면 컴파일러가 나몰라라함.
5. 그래서 unaligned 로 작성하면 오홍~ 하고 하드웨어에 잘 물려줌.
( 물론 이렇게 해 주는 플랫폼의 경우지. 그게 우리가 주로 사용하는 x86, x64 인거고 )
즉,
우리가 하려던건 결국 unaligned 주소의 src, dst 에 대한 memcpy 야.
그걸 하드웨어가 잘 해주면 결과는 본질적으로 똑같아. 캐시 플로우 정도의 차이가 있을 뿐이야.
근데,
C++ 에서 unaligned access 가 최적화를 위한 선택이란 것에 대해 그렇지 않다! 라고 주장하는 넘은
intel architecture 를 잘 모르는 넘이지.
나중에 컴파일러가 똘똘해져서, bit-shift 도배해놔도 unaligned 로 간단히 표현한 만큼
최적화를 알아서 잘해주는 시대가 올지 모름.
적어도 아직까진 그건 현실이 아님.
실험이 나오고 반증이 끝났는데도 결과에 승복안하네 ㅋㄷ
저런 꼴통은 처음이다. 지가 짠 코드 1MB 돌린 결과도 이야기 안해 ㅋㅋ
쿠캬캬는 코드를 공개했고 검증을 받았다. 너는? 포토샵질로 올린거 몇개? ㅋㅋㅋ 이쯤 되면 그냥 승복하는 것도 좋단다. 정말 진심 걱정이다. 사회생활은 잘 하고 있는지... 혹시 보안쪽에서 바이러스 탐색하다가 진짜 바이러스에 영향 받은거냐?
포샵질이라면 내가 어떻게 결과 데이타를 다 알고 있지?
내가 신이니?
ㅋㅋㅋㅋㅋㅋㅋㅋㅋㅋㅋㅋㅋㅋㅋㅋㅋㅋㅋㅋㅋㅋㅋㅋㅋㅋㅋㅋㅋㅋㅋㅋㅋㅋㅋㅋㅋㅋㅋㅋㅋㅋㅋㅋㅋㅋㅋ
개그하네 ㅉㅉ
쿠캬캬 스스로 앞 데이터 다 번복하고 마지막에 내 놓은 데이터 내가 1분도 안걸려 그건 맞고 1MB 돌려보라고 이야기 했지. 냠냠.
DON'T FEED THE TROLL
ㄴ 먹고 살아남으렴. 트롤아.
지가 스스로 지 앞선 데이터 다 부정했는데 아직도 상황 파악이 안되니? 뭐지 이 병신들은 ㅡ,.ㅡ
이제 쿠캬캬 열받아서 명예회복해볼려고 열심히 4KB ~ 4MB 대역 최적화 해 오면, 니네들은 감사하고 꿀꺽 먹으면 된다. ㅋㄷㅋㄷ
하지만 그건 이미 첫 게임이 끝난거지 연장게임이 아냐.
인텔 베이스 c++ 에서 aligned 는 src-dst 구조에서 컴파일러 최적화가 너무 취약해
그건 이미 결론이 다 난거가 되는거고 쿠캬캬 혼자, 못배워 쳐먹고 헛소리했던 것에 대한 보상을 인트린직 끌어안고 우는거라고 ㅋㄷ
근데 솔까말 인트린직으로 그렇게 도배해 놓으면 코드 유지보수 진짜 좆같아져서 별로 응용할 여지는 많지 않을게야.
내가 다 경험하고 하는 소리니께
아 이 새끼는 진짜 하는 소리마다 개소리네. 지금 내가 인트린식 끌어앉고 낑낑대는 이유를 몇번을 귓구녕에 꽂아줘야하는겨? 표준C++ 버전 코드는 msvc가 memcpy로 치환하는데 이걸 끌 방법이 없다고 몇번을 얘기해? 일단 gcc 세그폴트 얘기면 UB문제는 끝난거고, 그럼 instruction level에서 aligned랑 unaligned랑 비교하는거만 남았따니까? 진짜 이 새끼는 지 코드 한줄도 없이 자꾸 주제를 뒤섞어서 돌아버리겠네.
야 c++ 버전 unaligned access 버전 릴리즈 모드로 빌드해다가 디스어셈블해와라.
memcpy 로 바뀌는게 아니라고 병신아.
니가 똑바로 최적화 옵션 다주고 release 디스어셈블해봐.
니 말대로 memcpy 로 바뀌는거면 memcpy 보다 빠른 경우는 왜 생기고 2배 느린 경우는 왜 생기는데 등신아.
그리고 그건 애초에 C++ 에서 unaligned aligned 구현 선택 이슈랑 아무 관계가 없어. 병신아.
하드웨어에서 허용하고, 가속까지 해주니까 그게 의미 있는거라고, 상식적으로 이건 unaligned src-dst 구조란걸 이해 못하는거냐?
컴파일러가 잘 받아주고 인트린직으로 잘 옮겨줘서 unaligned 가 더 손쉽게 최적화 되는거고, 니가 니손으로 직접짠 intrinsic 버전 unaligned 도 memcpy 보다 빠른데 뭔 개소릴 자꾸해?
살다 살다 이런 꼴통은 첨일쎄... 와... 대단하다.
코세님 힘내세여! 전 아직 실력이 모잘라 잘 모르지만 코세님이 이정도로 확신을 갖는거 보면 코세님이 맞는거 같아요
힘낼 필요 없어. ㅋㄷㅋㄷ 걍 놀리는거임. 이 이슈는 길게 끌면 끌수록 저시키는 늪에 빠질 뿐이여.
공부는 좀 많이 되겠지 뭐~
근데 워낙 애가 싸가지가 없어서 별로 공부시켜주고 싶은 상댄 아니넹.
저 사실 고닉이 있는데, 고닉으로 말하다간 저분들한티 찍힐거 같아서 ㅠㅜ 이렇게 유동닉으로 말합니다. 항상 많은 도움 주시는데, 코세님이 여기서 이런 대우를 받는다는게 너무 슬프네여
ㅅㅅㅅ님이 있엇더라면 코세님 주장에 더욱 힘을 보탤텐데..
주장은 무슨 데이타 다 나와 있는데 ㅋㄷㅋㄷ
저녀석 혼자 지가 짠 코드 결과 내버려두고 열심히 unaligned 는 느리다 식의 아티클만 긁고 있는거임.
걍 실험할줄 모르는 멍청한 새끼임.
전 아직 저런 하드한 부분까지는 잘 몰라서.. 지켜 볼 수 밖에 없네요. 죄송합니다
기본적으로 aligned 빠른거 누가 모름? 예외를 딱 제시해도 저지랄 ㅋㄷ
응 그냥 지켜보면 돼. 누가 편 안들어도 됨유.
걍 쿠캬캬 저 바보도 공부되겠지~
코세님 aligned이랑 unaligned ?? 무슨 내용으로 논쟁하는지 알기쉽게 요약해주실수 있나요?
인트린직으로 잘 옮겨줘서 가 아니라 sse 로 지 음냠
응 잠만 담배 한대 피고 그려줄게
내 유동닉이 바보 인거니까 닉은 신경 안써도 됨유