llm 모델/가중치 공개도 의미있지만, 학습 텍스트 데이터를 공개해야 그게 의미가 더 있음.


llm 모델 개발에 대한 핵심 기술은

이미 논문, 특허, 오픈소스 등으로 광범위하게 공개되어 있는데 반해,

학습된 데이터 목록 및 정제에 대해서는 공개되 되어 있지 않고, 이러한 부분들이 현재에도 논란임.

아무튼 그러하옵니다.

입만 열면 잘난척 해서 죄송합니다.

소인이 아뢰옵기 황송하오나,

저의 최대 단점이기도 하죠 ㅠㅠ

읽어주셔서 성은이 망극하옵니다.