제대로된 공대가서 학부 졸업만 해도 거의 대부분의 시스템은 인풋과 아웃풋에 대해 비선형적 이라는 걸 아주 잘 알게 됨
하물며 비선형 미방 덩어리인 강화학습은 어떠겠음 ㅋㅋ
아주 간단하게 모델링해봐도 데이터의 차원이 높아질수록 단위 부피에 대한 단위구의 비율은 차원 하나마다 급격하게 내려가서 저걸 우회하려고 연구자들이 얼마나 삽질하는데... (e.g. KNN 알고리즘)
그냥 고졸 특슬람 1, 2로 취급하고 무시하고싶은데 멍청한애들이 똑똑한척하는것만큼 화나는게 없어서 ㅈㄴ게 긁힌다
?
오픈ai 테크니컬 리포트 보면 현재 LLM 알고리즘의 로스 하한은 정해져 있고 로그스케일로 감소함
맞네 바로 LLM의 성능이 비선형적으로 증가한다는 예시를 가져와줘서 고마워
태글거는건 어닌데 강화학습이 비선형 미방이엿나? 그냥 비선형 함수 아님?