#-*- coding: cp949 -*-
import urllib2, re
code = urllib2.urlopen("https://www.facebook.com").read()
par = '<p>(.+?)</p>'
a = re.findall(par,code)
for i in a:
print i
일단 코드는 이렇거든?
파싱을 어디서 알려주는데도 없고 뒤적거리다가 보니까 <어쩌구저쩌구> </어쩌구저쩌구> 이렇게 사이에 있는거 가져오려면 저렇게 하면 된다길래
페북 소스를 보니까 담벼락글들은 <p> 게시글 </p> 이렇게 되있더라고
그래서 저렇게하면 불러와 질줄알았는데
브라우저에서 JavaScript를 활성화하거나 Javascript 이용이 가능한 브라우저로 업그레이드하신 후 Facebook에 가입하세요.
결과창엔 이런 요상한 놈밖에 없어 이거 뭐야?? 혹시몰라서 로그인해놓고 켜놓고 다시 돌려봤는데 똑같네
json 이용해서해라 api도 다오픈되어있는데 왜 저런식으로하지? 참고로내가3년전에해봣으니까 지금은 더쉽게되것네
좀 더 잘 살펴봐라