지금은 사라진 웹사이트의 페이지 내용을
통째로 저장해놨는데 (html파일, 이미지 있음)
html 파일로 불러오니까 해당 사이트 로고나
글 내용과 관계없는 다른내용이 좀 있는데
이것만 지우고 혹시 html이 아닌 pdf나 엑셀같은 문서로 쉽게 저장할 방법이 있을까요?
어디 여쭤봐야 할지 몰라서 여기에 여쭙습니다
지금은 사라진 웹사이트의 페이지 내용을
통째로 저장해놨는데 (html파일, 이미지 있음)
html 파일로 불러오니까 해당 사이트 로고나
글 내용과 관계없는 다른내용이 좀 있는데
이것만 지우고 혹시 html이 아닌 pdf나 엑셀같은 문서로 쉽게 저장할 방법이 있을까요?
어디 여쭤봐야 할지 몰라서 여기에 여쭙습니다
크롬의 인쇄메뉴에서 pdf로 저장이 가능하지않습니까?
지금은 사라진 포럼의 글인데 그렇게 하니까 해당사이트 로고와 다른글의 제목 같은게 포함되더라구요.. 불필요한 정보는 다 빼고 제가 원하는 내용만 긁어서 저장하고싶어서.. 복사붙여넣기 식으로 구글 시트같은데서 불러와지는지 한번 확인해볼게요
프로그램으로 HTML파서 라이브러리에서 본문 내용만 잘라서 별도 파일로 출력 저장하면 됩니다. 같은 포멧 여러장이면 이렇게 프로그램 짜서 자동화하면 되고. 문서가 몇개 없으면 HTML 편집기나 웹브라우저로 본문 내용반 복사해서 HTML 새문서 만들어서 붙여넣기 하면 내용만 붙여넣기 되니까 그거 저장하면 됩니다. 문서 저장 포멧은 MHTML이나 PDF로 하면 됩니다.
답변 감사합니다!