~기반이다 하는건 같은 모델 RL로 우려먹는 gpt나 해당하지 클로드는 모델 크기부터 아예 다른 모델인데 이게 말이 됨?
오푸스가 미토스같은 초대형모델에서 증류로 뽑아내는건가? 잘모르겠는데 미토스따로 오푸스따로 학습시키는건 ㅈㄴ 비효율적일거같은데
제미나이도 플레시는 버전마다 프로랑 성향 비슷하잖아
기반이 같을수가 없는데 파라미터크기가 다르잖아
증류를 하든 뭘 하든 같이 엮여있는 모델은 맞을거같은데 애초에 오푸스를 학습시키면서 미토스까지 따로 학습하는건 너무 비효율적임
@ㅇㅇ 토크나이저가 바뀐건 맞는데 4.8오푸스는 기반이 4.7이랑 똑같을꺼임
토크나이저가 같은거지 비약이 너무 심하네 - dc App
~기반이다 하는건 같은 모델 RL로 우려먹는 gpt나 해당하지 클로드는 모델 크기부터 아예 다른 모델인데 이게 말이 됨?
오푸스가 미토스같은 초대형모델에서 증류로 뽑아내는건가? 잘모르겠는데 미토스따로 오푸스따로 학습시키는건 ㅈㄴ 비효율적일거같은데
제미나이도 플레시는 버전마다 프로랑 성향 비슷하잖아
기반이 같을수가 없는데 파라미터크기가 다르잖아
증류를 하든 뭘 하든 같이 엮여있는 모델은 맞을거같은데 애초에 오푸스를 학습시키면서 미토스까지 따로 학습하는건 너무 비효율적임
@ㅇㅇ 토크나이저가 바뀐건 맞는데 4.8오푸스는 기반이 4.7이랑 똑같을꺼임
토크나이저가 같은거지 비약이 너무 심하네 - dc App