이미 gpt던 gemini던 grok이던 llama던 심지어 네이버 클로바x도
다 비슷비슷한 웹 데이타 학습한건데
이거 내놔 하면 지들이 그걸로 뭘 할껀데
심지어 같은 데이타로 학습해도 파라메타 수치는 다 다를텐데
파인튜닝 해보니 같은걸로 같은 방식으로 학습했는데 두번 해보면 두개가 미묘하게 다름
이미 gpt던 gemini던 grok이던 llama던 심지어 네이버 클로바x도
다 비슷비슷한 웹 데이타 학습한건데
이거 내놔 하면 지들이 그걸로 뭘 할껀데
심지어 같은 데이타로 학습해도 파라메타 수치는 다 다를텐데
파인튜닝 해보니 같은걸로 같은 방식으로 학습했는데 두번 해보면 두개가 미묘하게 다름
원래 이론적으로 동일한 환경에서는 모델 파라미터도 동일해야 되는데? 랜덤 시드 고정 안한거 아님?