llm 모델/가중치 공개도 의미있지만, 학습 텍스트 데이터를 공개해야 그게 의미가 더 있음.
llm 모델 개발에 대한 핵심 기술은
이미 논문, 특허, 오픈소스 등으로 광범위하게 공개되어 있는데 반해,
학습된 데이터 목록 및 정제에 대해서는 공개되 되어 있지 않고, 이러한 부분들이 현재에도 논란임.
아무튼 그러하옵니다.
입만 열면 잘난척 해서 죄송합니다.
소인이 아뢰옵기 황송하오나,
저의 최대 단점이기도 하죠 ㅠㅠ
읽어주셔서 성은이 망극하옵니다.
댓글 0