댓글들 여러개 크롤링해서 댓글들마다 단어들 뽑아와서 word2vec으로 벡터 거리 계산하고 클러스터링을 했었는데 이렇게 하니까 단어간의 거리를 이용해서 클러스터링이 되어 버리는 문제점이 있었음. 내가 원하는건 댓글들 사이의 거리를 측정해서 댓글들을 클러스터링 하는거라 즉, 댓글들 안에 여러 단어가 존재하고 그 단어들의 집합인 댓글을 하나의 점으로 보고 클러스터링을 하고 싶은건데 이걸 어떻게 해야할까. 아까 doc2vec 사용하라던 사람이 있었는데 이게 문서간의 벡터거리 계산해주는건데 하나의 댓글에서 나온 단어들의 집합을 하나의 문서로 만들고 그 문서들을 doc2vec에 집어넣고 하면 되는 것 같긴한데 이 문서화하는 작업은 또 어떻게 해야하는건지 잘 모르겠음. 더 좋은 방법이 있거나 이 방법에 대해 잘 아는 사람은 댓글 좀 달아주셈