wget을 사용하여 크롤링하여 HTML 파일 만 다운로드하는 방법 (이미지, CSS, JS는 무시)
기본적으로 Wget으로 전체 사이트를 크롤링하고 싶지만 다른 자산 (예 : 이미지, CSS, JS 등)을 다운로드하지 않아야합니다. HTML 파일 만 원합니다. Google 검색 은 완전히 쓸모가 없습니다. 내가 시도한 명령은 다음과 같습니다. wget --limit-rate=200k --no-clobber --convert-links --random-wait -r -E -e robots=off -U "Mozilla/5.0 (X11; Linux x86_64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/32.0.1700.102 …