챗지피티한테 물어보도록
qlora는 학습 비용 절감시킬려고 쓰는거지 소설같은 간 문장에 정확도도 필요한건 lora쓰면 안됨 lora 공부하고 와라
그럼 fft 하라고?
니가 알아서 해야지 freezing을 하던 full로 하던 니가 이것저것 시도해봐
정 못하겠으면 크몽이나 이런데 돈내고 시키고 배우돈거
gpt 결제한 다음에 소설 잘쓰게 해주는 프롬프트를 넣으면 됨
걍 RAG로 소설 자체를 Vecdb로 만들어서 gemini api로 만드는게 성능 뺨 후려침
특정 소설에 대해 하려는게 아니라 걍 범용적인 소설 창작용 도우미를 만들고싶었음 무리일까
27b 따리로는 범용은 어렵지 Only en만 써도 안될듯 기존의 편향 벗겨내기가 존나힘듬
Gemma 3 27b 자체가 꽤나 성능이 있어서 편향 벗겨내고, 문체 바꾸고, 클리셰 떠먹여주면 따라가는 정도만 되면 된다 생각했고 그래서 학습을 시작했는데 ㄹㅇ 답도없음. 개빡셈. 이제 10000토큰 × 600스텝 돌렸는데 막막하다...
lora rank가 64 따리에 qlora라 그런가 이거 학습을 아무것도 못한 느낌임... 1에포크면 8000만 토큰 본 게 되는데, 이정도면 의미가 있을까?
애초에 소설 자체가 쉽게 구할수 있는 데이터이니 이미 엥간한 모델들 학습시킬때 다 넣었을테고 충분히 봐서 더 안오르겠지
그래서 알긴 하는데, 문체가 옛날 작품 많아서 옛날 느낌이고, safety 관련해서 튜닝한거랑 chat 튜닝한거 때문인지 짧고 결론짓는듯한 내용이 나오니까
챗지피티한테 물어보도록
qlora는 학습 비용 절감시킬려고 쓰는거지 소설같은 간 문장에 정확도도 필요한건 lora쓰면 안됨 lora 공부하고 와라
그럼 fft 하라고?
니가 알아서 해야지 freezing을 하던 full로 하던 니가 이것저것 시도해봐
정 못하겠으면 크몽이나 이런데 돈내고 시키고 배우돈거
gpt 결제한 다음에 소설 잘쓰게 해주는 프롬프트를 넣으면 됨
걍 RAG로 소설 자체를 Vecdb로 만들어서 gemini api로 만드는게 성능 뺨 후려침
특정 소설에 대해 하려는게 아니라 걍 범용적인 소설 창작용 도우미를 만들고싶었음 무리일까
27b 따리로는 범용은 어렵지 Only en만 써도 안될듯 기존의 편향 벗겨내기가 존나힘듬
Gemma 3 27b 자체가 꽤나 성능이 있어서 편향 벗겨내고, 문체 바꾸고, 클리셰 떠먹여주면 따라가는 정도만 되면 된다 생각했고 그래서 학습을 시작했는데 ㄹㅇ 답도없음. 개빡셈. 이제 10000토큰 × 600스텝 돌렸는데 막막하다...
lora rank가 64 따리에 qlora라 그런가 이거 학습을 아무것도 못한 느낌임... 1에포크면 8000만 토큰 본 게 되는데, 이정도면 의미가 있을까?
애초에 소설 자체가 쉽게 구할수 있는 데이터이니 이미 엥간한 모델들 학습시킬때 다 넣었을테고 충분히 봐서 더 안오르겠지
그래서 알긴 하는데, 문체가 옛날 작품 많아서 옛날 느낌이고, safety 관련해서 튜닝한거랑 chat 튜닝한거 때문인지 짧고 결론짓는듯한 내용이 나오니까