솔직히 문서보다
유튜브,뉴스가 LLM 입장에서는 더 깨끗한 데이터 아닐까?
STT만 잘 되면 되게 클린한 데이터일꺼같음
구하기도 쉽지않을까?
프리트레인으로 유아용 영상을 학습한 다음 파인튜닝으로 점점 지식을 추가하는 방법도 어떨지 궁금함
솔직히 문서보다
유튜브,뉴스가 LLM 입장에서는 더 깨끗한 데이터 아닐까?
STT만 잘 되면 되게 클린한 데이터일꺼같음
구하기도 쉽지않을까?
프리트레인으로 유아용 영상을 학습한 다음 파인튜닝으로 점점 지식을 추가하는 방법도 어떨지 궁금함
댓글 0