데이터베이스랑 자연어처리 이런거 배우려면 어떻게 하나요
검색엔진 소스코드 같은거 볼 수 있는 방법 없나요?
익명(121.64)
2017-11-01 20:48
추천 1
댓글 15
다른 게시글
-
장도리에어로홍(aerohong) | 17.11.01추천 0
-
배열돌리기 질문.. [1]코딩초짜(119.192) | 17.11.01추천 1
-
백왕 형님과 친해지고 싶으면 어떻게 하면 좋을까요?백왕바라기(223.62) | 17.11.01추천 1
-
node 독학중인 학생인데 소켓이랑 ajax 관련해서 질문이 있습니다..ㅁㄴㅇㄹ(118.223) | 17.11.01추천 0
-
웹공학 빅데이터 둘 중에 뭘 배우는것이 좋을까요익명(183.109) | 17.11.01추천 0
-
자바밖에 모르는데 C해야되냐 [1]익명(121.164) | 17.11.01추천 0
-
안스 그래들 3.0 버그 또다른거 하나 [2]익명(223.38) | 17.11.01추천 1
-
깃헙 궁금한 게 있는데Gnanaht(gnanaht) | 17.11.01추천 0
-
안스 3.0 그래들에 버그있다 [6]익명(223.38) | 17.11.01추천 1
-
난 간혹가다 vim 쓸때 이런느낌 으로 쓴다.. [2]PeVrip(59.23) | 17.11.01추천 0
루씬 해봐.
구글 들어가서 오른쪽버튼 누르면 소스 보기 있는데 그걸로 구글 소스코드 다 털림
ㄴ 그건 검색엔진이랑 관련 없지 않나요
진지충 십극혐
검색의 a to z는 인덱스임
인덱스를 잘 만들고 처리하기 위해선 형태소 분석, n-gram, PMI, Word2vec 등을 쓰면 좋음. 여기에 클러스터링도 쓸수 잇고
형이 진지충 불쌍해서 알려준다 으휴
비슷하게 이미지 검색도 이미지에서 특징점 뽑고(가장 기초적으론 sift부터) 메트릭 계산하는거 짜고 이런 식으로 동작해
ㄴ 검색마스터님 감사드립니다... 일단 정리하고 나중에 또 물어봐야겠네요
아 그리고 저 위에 내가 미친놈처럼 써놧는데 ngram -> PMI -> word2vec은 발전순서라서 다 같이쓰진 않고 저중에 잘되는거 태스크특성에 따라 쓰는게 보통임
형태소 분석은 꼭 해야 하고 더 하면 좋은건 normalization(스펠링 에러같은걸 고쳐서 정규화된걸로 바꾸는것)인데 이는 데이터가 많으면 유사도(PMI, Word2vec) 로 처리하거나 초보적으로는 에딧디스턴스 봐서 하면 돼
인덱스 관리 및 개발 능력이 검색엔진 제1의 기술이라 봐도 과언이 아니니까 아무튼 열공하고와라
ㄴ 감사합니다! 시멘틱 검색은 뭔가요? 그리고 구글이 남다른건 인덱스 양이랑 알고리즘인가요?
엘라스틱서치 공부하면 됨
구글은 사실상 검색 엔진이 아니라 QA머신 아니냐 질문에 대한 답을 내어준다는 느낌이라서.. 아마 그리고 시맨틱 검색이란 용어가 이걸 가리키는 걸까야