a14320aa22166beb3cf1c6bb11f11a396f6c5d3165faa3c640


https://quasarzone.com/bbs/qn_hardware/views/1617169

퀘이사존에서 15세대 관련 정보를 찾아보는데 보니까 하이퍼스레딩을 없앤다는 말이 있더라고요

이거 자체는 이전에도 봤던 내용이지만 하이퍼스레딩 대신 Rentable Units를 쓴다는 말이 나와서 궁금해졌어요


https://www.hardwaretimes.com/intel-15th-gen-cpus-to-get-rentable-units-why-hyper-threading-is-going-away/

Intel 17th Gen CPUs to Get Rentable Units: Why Hyper-Threading is Going Away | Hardware TimesIntel’s adoption of a hybrid core architecture has significantly changed the roadmap of the PC chipmaking industry. More and more applications are now taking advantage of the “secondary” low-power P-cores to boost performance as well as efficiency. Of course, this approach has its own shortcomings, which Intel plans to iron out in the coming years. …www.hardwaretimes.com


https://rog-forum.asus.com/t5/rampage-vi-strix-x299-series/new-intel-rentable-unit-to-replace-hyper-threading-since-lion/td-p/950972

New Intel Rentable Unit to replace Hyper-Threading Since Lion Cove Microarchitect to future.Say goodbye to Intel old favorite SMTrog-forum.asus.com


검색하니 바로 뜨더라고요


우선 제가 학부생따리라 아키텍쳐 이런거 1도 모르고 걍 100% 뇌피셜이에요

헛소리하는거니 재미로만 봐주세요


0c8ffd66b35ec6632e3405449d11e87d17d820f41498d5595541b708b4da33f9b58804d638f19c5e07bf0d190f1120873e08ed2148fe2269444fe6eca7dd8c04a2e47df413cc

여기에서 SMT가 바로 하이퍼스레딩인데, 코어의 자원을 모두 활용해서 동시에 처리할 수 있는 일을 모두 욱여넣은걸 볼 수 있어요


예를 들어보자면

Course MT는 하나의 스레드를 쭉 이어가다가 중간에 버블이나 스톨이 발생하면 다른 스레드로 넘어가는 그런 식이고

Fine MT는 그냥 너 몇 클럭동안만 연산해 라고 정해두고 여러개의 스레드를 계속 돌려가며 연산하는 그런 식인 거에요

SMT, 하이퍼스레딩은 이제 예를 들면 1번 스레드에서 정수 연산만 대차게 하고 있다, 그러면 2번 스레드는 FP 연산을 해야 하니 걍 둘이 동시에 연산해라! 이런 식이고요


이러면 코어에서 갈굴 수 있는 부분은 다 갈구는 것이니 효율을 최대한 뽑아낼 수 있죠

(아마도요? 제가 이해한 건 이래요)


근데 이게 엘더레이크 이상의 p,e코어로 나눠진 아키텍쳐로 들어오면서 비효율성이 생긴 모양이에요


1fb8de32ecdc3feb5bb1dfa15bf42e38d32807ee14ccc8b4126792ef344423d2d6486f23ea28a96f1e934552b9

위 사이트에서 가져온 사진인데, 스레드1은 P코어, 스레드2는 E코어에 해당한다고 해요

보다시피 p코어는 일찌감치 작업을 끝내고 쉬고 있고, e코어는 또 폐급이라 작업이 질질 끌려서 전체 성능이 발목잡히는 걸 볼 수 있죠


그래서 도입하는게 Rentable Units인데, 저 스레드들을 작업의 부하 정도, cpu 자원 등등에 따라 나눠서 각 코어에 분배한다고 해요

그렇게 해서 모든 코어가 쉬는 일 없이 골고루 갈궈서 우측처럼 전체 성능이 증가하는게 목표라고 하네요


대충 저 2개만 찾아본거라 정확히 어떤 식으로 작업을 분배하는지 이런 것까진 모르겠지만(사실 본다고 해도 이해 못 하겠죠)

어쨌든 기존 하이퍼스레딩보다 더 유연하고 효율적이라고 하더라고요


다만 이런 작업을 수행하려면 캐시와 레지스터가 대량으로 필요하다고 하는데, 퀘존 뉴스 보니 애로우레이크에서는 캐시도 추가로 넣어준다고 하네요

l4 캐시가 들어간다는 루머도 전에 있었는데... 얘도 들어가려나?



개인적으로는 HT가 2개의 논리 스레드로 나뉘어졌다면 RU는 그 스레드를 물리적 코어인 e코어로 이전했다는 생각이 드네요

HT가 없어지는만큼 코어 하나의 활용도는 좀 떨어지겠지만, 어차피 요즘 코어 24개씩 넣겠다 p,e코어와 멀티코어 구조를 제대로 활용해보겠다는 그런 느낌?