답변:
운이 좋으며 저자가 위키에 있고 그 / 그녀의 이름이 한 번만 존재하면 (모호하지 않은 경우)이 접근 방식을 사용할 수 있습니다.
$ cat mywiki.sh
NAME=$(echo $@ | tr " " "_")
wget -O $NAME.html https://en.wikipedia.org/wiki/$NAME
lynx -dump $NAME.html > $NAME.txt
dataurl=$(awk 'sub(/.*www.\wikidata\.org/, "http://wikidata.org") {print; exit}' $NAME.txt)
lynx -dump -nolist $dataurl > $NAME.dat
이 방법으로 페이지의 html 코드, 정보는 같지만 html 태그는없는 txt 및 dat는 html 라인에 작성자 (및 wiki 페이지)의 주요 데이터를 포함합니다. 이러한 파일을 필터링하고 csv / html 테이블을 작성하기 위해 다른 필터 스크립트를 작성할 수 있는데,이 테이블을 열면 수동으로 조사해야 할 사항에 대한 개요를 쉽게 얻을 수 있습니다.