댓글들 여러개 크롤링해서 댓글들마다 단어들 뽑아와서 word2vec으로 벡터 거리 계산하고 클러스터링을 했었는데 이렇게 하니까 단어간의 거리를 이용해서 클러스터링이 되어 버리는 문제점이 있었음. 내가 원하는건 댓글들 사이의 거리를 측정해서 댓글들을 클러스터링 하는거라 즉, 댓글들 안에 여러 단어가 존재하고 그 단어들의 집합인 댓글을 하나의 점으로 보고 클러스터링을 하고 싶은건데 이걸 어떻게 해야할까. 아까 doc2vec 사용하라던 사람이 있었는데 이게 문서간의 벡터거리 계산해주는건데 하나의 댓글에서 나온 단어들의 집합을 하나의 문서로 만들고 그 문서들을 doc2vec에 집어넣고 하면 되는 것 같긴한데 이 문서화하는 작업은 또 어떻게 해야하는건지 잘 모르겠음. 더 좋은 방법이 있거나 이 방법에 대해 잘 아는 사람은 댓글 좀 달아주셈
클러스터링 관련 질문 좀
익명(14.46)
2020-10-11 02:52
추천 0
댓글 1
다른 게시글
-
임베디드 개발자 선배님들 조언 구합니다. [1]괴신(61.100) | 20.10.11추천 0
-
수 과탐 1등급 아닌 새끼가 있나 ㅋㅋ [2]익명(106.241) | 20.10.11추천 1
-
연결리스트 스택 질문점 [5]익명(119.18) | 20.10.11추천 0
-
개발자들아 꿈을깨라 현실익명(175.223) | 20.10.11추천 0
-
27이면 존나 늦은건데 [3]익명(106.241) | 20.10.11추천 1
-
공부한다고 꼴깝떨어서 친구 연락 다끊었는데 [1]익명(121.137) | 20.10.11추천 0
-
c언어 구조체 질문좀.. [3]익명(211.224) | 20.10.11추천 0
-
얼마 벌면 성공이냐 ??? [6]익명(222.110) | 20.10.11추천 0
-
요즘 나오는 컨텐츠들은 초반부에 90%역량을 쏟아붙는거같다익명(222.110) | 20.10.11추천 0
-
나랑 키배뜰새끼 있냐? [6]익명(106.241) | 20.10.11추천 0
tf-idf 라고 조금 된 통계 모델 하나 있는데 함 봐바 나 옛날에 청원 글 분석하고 비슷한 청원 글 거리구해서 찾을 때 이거 조금 변형해서 사용햇슴