싶습니다.
안녕하세요. 저는 지난 게임스탑(gamestop) 주가 폭등사건에 대해서 관심을 가지고, 당시 폭발적인 화제가 되었던 wallstreetbets 레딧 사이트에 대해서 연구를 해보려고하는데요.
일단 저는 wallstreetbet의 데이터 아카이브를 jsonal 파일로 받은 상황입니다(약 7기가)
이를가지고 저는 구문분석을 해보려고하는데요, 이를 위해서는 먼저 데이터 아카이브에서 "제목"만 추출해보고싶어요...
질문인데요.
이를테면 "body"라는 값을 추출하면 My toddler is dressed as a hamburger today. Long MCD 로 되는 것 같아요...("추출"의 뜻이 저거 맞죠..?)
원문: {"body":"My toddler is dressed as a hamburger today. Long MCD","created_utc":1572566434.0 (중략)
이런 식으로 추출해서 새로운 파일에 저장하고 싶은데 ..
제목
날짜1 body A
날짜2 body B
이런식으로 추출하고싶거든요..
명령어를 어떻게해야할까요...
기초지식도없이 질문을 드려 죄송합니다. 하지만 댓글을 써주신다면, 그 댓글을 가지고 더 공부해서 알아내겠습니다.
만약 답변주신다면 피와 살이 될것 같아요..
데이터아카이브파일은 아래가 예시입니다
파이썬 해봤으면 pandas dataframe 검색..
한번 찾아보겠습니다 감사합니다
어려운게 많네여... 먼저 파일용랑이 너무 큰건지 Atom 프로그램이 무반응일때가 많습니다
사회과학 멋있다 - dc App
용량이 크면 notepad++를 사용하고 그래도 크면 ultra edit 이나 json buddy 같은것도 있음