요즘나오는것들보면 작은크기에 성능 꾹꾹눌러담고 데이터셋없이 파라미터만 늘리는건 너무 효율떨어지는거같던데

Qwen2.5 72B가 라마 3.1 405B랑 비빈다던가 라마3.2는아예 90B가 제일큰모델이라던가

OAI도 4o로 파라미터수상당히낮춘거같고 (머이건MoE때문에 파라미터수얼만지모르긴하지마는)

그나마 GPT-5는 크게나오겟지정도기대는하지마는 오푸스가 나오긴할까 거기서부터 의문이에요 취소해도이상할게없지안으려나