연산쪽은 몰라도
추론시간,사전학습시간 스케일링은 아직도 유효하다는 게 o시리즈로 증명됐음
오히려 성능향상은 추론시대인 지금이 역사상 가장 빠르고
사전학습 스케일링이 끝났다는 내용으로 이해했는데
메론 콜라에 타서 먹어 - dc App
모델 파라미터 갯수와 사전학습시간 측면에서의 스케일링이 끝났다는 의미인거지
추론시간 측면에서 스케일링은 유효할거고
사전학습 스케일링이 끝났다는 내용으로 이해했는데
메론 콜라에 타서 먹어 - dc App
모델 파라미터 갯수와 사전학습시간 측면에서의 스케일링이 끝났다는 의미인거지
추론시간 측면에서 스케일링은 유효할거고