파싱이라는걸 한번도안해봤는데
하게된다면 라이브러리 쓰겠지..
파싱해서 json값을 받아온다고 쳤을때?(맞나?)
아니면 html전체를 파싱해오나?
라이브러리마다 틀리낭??
여튼 가져온다치면 리스트의 글과 댓글수만 어케뽑앙
아니면 dc에서 제공해주남?
파싱이라는걸 한번도안해봤는데
하게된다면 라이브러리 쓰겠지..
파싱해서 json값을 받아온다고 쳤을때?(맞나?)
아니면 html전체를 파싱해오나?
라이브러리마다 틀리낭??
여튼 가져온다치면 리스트의 글과 댓글수만 어케뽑앙
아니면 dc에서 제공해주남?
strstr
string.find
dclite라는 크롬익스텐션 보니까 dc에서 제공하는 rest api 쓰더라고, json으로 정보 주던데. 근데 api 쓸때 무슨 인증코드같은거 쓰는 모양이더라. dclite꺼 그냥 베껴써도 되긴하던데 얼마나 갈지 모르는거고
아마 그 인증코드로 api써서 도배기나 크롤러같은거 만들면 dclite까지 피해보겟지
1. 파싱을한다 -> 2. dom트리로 변환후 특정 어트리먼트를 모은다 or 정규식으로 모은다 -> 활용 이런식인건가..?
http 함수로 주소 html 긁어온다-html 파서 라이브러리로 dom이나 sax 방식으로 원하는 엘레먼트를 검색한다-엘레먼트가 링크나 이미지면 다시 다운로드 한다-파서의 인스턴스를 파일이나 디비로 저장한다
node.js가 편함 스트링형으로 html글 긁어온 다음 파싱하면 오브젝트로 변환함 그다음 제이쿼리 css셀렉터로 글 제목이나 내용을 가져옴