Gibt es eigentlich einen eleganten Weg um alle PDF-Dateien von einer bestimmten URL über Archive.org herunterzuladen?
Im Sinne von GET \....\* ?
- alle URLs mit Endung .pdf aus der html-Datei pulen - z.B. mit awk - Skript generieren, das die Dateien mit wget herunterlädt - Skript ausführen Ist aber nur im Prinzip einfach ;-)
Besten Dank, irgendwie habe ich auf eine einfache Lösung gehofft, die ich übersehen habe. Zum halb-manuellen zurecht-trimmen der Links bin ich ein paar mal zwischen Notepad und Excel gewechselt. Jetzt laufen die Downloads mit wget und ich dazu habe einiges über die Unzulänglichkeiten der Windows-Kommandozeile dazugelernt ;o) Grüße Klaus
Antwort schreiben
Bitte melde dich an, um einen Beitrag zu schreiben.