Wayback Machine Downloader Tools: Was wirklich funktioniert
Von der Restorix-Redaktion · 9. Mai 2026 · 7 Min. Lesezeit

Stellen Sie Ihre Website aus der Wayback Machine wieder her
Kostenlose Schätzung in Sekunden — Sie zahlen erst bei Bestätigung. Fehlgeschlagene Wiederherstellungen werden automatisch erstattet.
Suchen Sie nach einem Wayback Machine Downloader, landen Sie bei denselben wenigen Tools, die seit einem Jahrzehnt jeder nutzt, plus einem Friedhof verlassener GitHub-Repos. Einige dieser Tools funktionieren wirklich. Alle teilen dieselbe Grenze. Das ist die Überprüfung, die ich mir gewünscht hätte, bevor ich meine erste Wiederherstellung durchgeführt hätte: Was die Open-Source-Skripte tatsächlich tun, wo sie aufhören und was Sie stattdessen verwenden sollten, wenn die Website wieder online gehen muss.
Was ein Wayback Machine Downloader tatsächlich tut
Jeder Wayback Machine Downloader ist unter der Haube dasselbe Gerät. Er fragt die CDX-API nach einer Liste von Erfassungen ab, durchläuft diese Liste und speichert jede Datei von ihrer zeitstempelten URL. Die besseren fügen Datums- und Dateitypfilter sowie Wiederholungslogik hinzu, wenn archive.org Sie zu drosseln beginnt. Keiner von ihnen kommuniziert mit einem geheimen Backup Ihrer Website. Sie scrapen dasselbe öffentliche Archiv, das Sie jetzt im Browser öffnen können.
Diese Unterscheidung ist wichtiger als jede Funktionenliste. Ein Downloader erbt jede Lücke im Archiv: die Seiten, die nie gecrawlt wurden, die Bilder, die nie erfasst wurden, das Verzeichnis, das von einer robots.txt-Datei blockiert wurde, die jemand 2015 falsch konfiguriert hat. Das Tool kann nur das abrufen, was existiert.
Die Zahlen werden auch schnell groß. Eine bescheidene 200-seitige Website wird, wenn man Bilder, Stylesheets und Skripte mitzählt, leicht zu 2.000 Dateien. Bei einer höflichen Anfrage pro Sekunde sind das über eine halbe Stunde reines Abrufen, bevor Wiederholungen, Drosselungen und die Dateien, die 404 zurückgeben, weil das Archiv sie vor Jahren verloren hat, hinzukommen.
Die Open-Source-Optionen
Stellen Sie Ihre Website aus der Wayback Machine wieder her
Kostenlose Schätzung in Sekunden — Sie zahlen erst bei Bestätigung. Fehlgeschlagene Wiederherstellungen werden automatisch erstattet.
Drei Namen tauchen in jedem Forum-Thread auf, und das aus gutem Grund:
- wayback-machine-downloader, ein Ruby-Gem. Das bekannteste der Reihe. Ein Befehl, wayback_machine_downloader http://example.com --from 2015 --to 2019, und es füllt ein ./websites-Verzeichnis mit jeder passenden Erfassung. Enthält ein Concurrency-Flag und filtert nach Dateierweiterung.
- waybackpack, ein Python-Tool. Lädt Erfassungen nach Zeitstempel organisiert herunter, was es gut für das Abrufen eines bestimmten Snapshots einer Seite macht und weniger auf Spiegel ganzer Sites ausgerichtet ist.
- HTTrack auf eine Snapshot-URL gerichtet. Kein richtiges Archivierungstool. Es folgt den umgeschriebenen Links, die Wayback in Seiten injiziert, und zieht einen ganzen Erfassungsbaum herunter. Unbeholfen, gelegentlich effektiv auf kleinen Sites und völlig verwirrt durch Abfragezeichenfolgen.
Alle drei sind kostenlos. Alle drei werden in Hobbytempo gepflegt. Und alle drei übergeben Ihnen einen Stapel Dateien. Was danach passiert, ist Ihr Problem, und dieser Satz deckt etwa achtzig Prozent des Folgenden ab. Bevor Sie eines davon installieren, lesen Sie die offenen Issues im Repo. Zehn Minuten dort sagen Ihnen mehr als jeder Vergleichsbeitrag.

Was Sie von einem kostenlosen Wayback Machine Downloader-Skript erwarten können
Stellen Sie die Erwartungen ein, bevor Sie etwas ausführen. Eine typische erste Sitzung mit einem kostenlosen Wayback Machine Downloader verläuft so: dreißig Minuten Kampf mit Ihrer Ruby- oder Python-Installation, zehn Minuten vielversprechender Fortschritt, dann beginnt archive.org mit 429-Fehlern zu antworten und alles verlangsamt sich zum Krabbeln. Eine 5.000-Dateien-Site mit höflichen Anfrageraten ist eine Übernachtungsaufgabe, und Übernachtungsaufgaben scheitern leise um 3 Uhr morgens.
Ein realistischer erster Durchlauf
- Installieren Sie die Laufzeitumgebung und das Tool. Debuggen Sie die Versionskonflikte, die niemand im README erwähnt.
- Führen Sie einen kleinen Test gegen ein Verzeichnis der Site durch, um das Ausgabeformat zu bestätigen.
- Starten Sie den vollständigen Durchlauf und beobachten Sie, wie die ersten hundet Dateien eintreffen.
- Treten Sie auf Geschwindigkeitsbegrenzungen, senken Sie die Parallelität, starten Sie neu und hoffen Sie, dass die Wiederaufnahmefunktion funktioniert.
- Öffnen Sie den Ausgabeordner und entdecken Sie den Müll, den Sie zusammen mit dem Gold heruntergeladen haben.
Die Ausgabe benötigt immer eine Sortierung. Es sei denn, Sie haben gut gefiltert, bekommen Sie jede Erfassung jeder URL: Tracking-Parameter-Müll, Druckansichten, Fehlerseiten, die trotzdem einen 200-Status zurückgaben. Und es sei denn, das Tool hat die id_-Varianten abgerufen, die originalen unveränderten Bytes, kommt jede HTML-Datei mit den umgeschriebenen Links und der Symbolleiste von Wayback noch darin.
Eine weitere Überraschung ist die Organisation. Die meisten Skripte kippen alles in zeitgestempelte Pfade, die das Archiv spiegeln, nicht Ihre ursprüngliche Verzeichnisstruktur. Den echten Ordnerbaum wiederherzubenzu und Dateien in das zurückzubenennen, was der Server nannte, ist manuelle Arbeit, für die niemand budgetiert.
Die Grenzen, auf die Sie stoßen werden
- Keine Wiederherstellungslogik. Ein Downloader ruft Dateien ab. Er entfernt nicht die Wayback-Symbolleiste, repariert keine internen Links, wählt keinen kanonischen Host und konvertiert nichts zu HTTPS.
- Keine Deduplizierungsintelligenz. Dasselbe Bild, das unter sechs Zeitstempeln gespeichert wurde, wird zu sechs Dateien, es sei denn, Sie fassen nach Inhaltstextur zusammen.
- Geschwindigkeitsbegrenzungen. Drücken Sie zu hart, und archive.org drosselt Sie oder blockiert Sie für eine Weile komplett. Wiederholungen sind ein normaler Teil des Workflows, kein Zeichen, dass Sie etwas falsch gemacht haben.
- Abhängigkeitsverfall. Skripte, die an alte Ruby- oder Python-Versionen gebunden sind, brechen auf modernen Systemen. Überprüfen Sie das Datum des letzten Commits im Repo, bevor Sie etwas installieren.
- Kein Support. Wenn das Tool kaputtgeht, ist der Issue-Tracker der Support-Schalter, und die letzte Antwort ist vielleicht von vor zwei Jahren.
- Keine Ziellinie. Wenn das Skript beendet, besitzen Sie einen Ordner. Diesen Ordner in eine gehostete, funktionierende Website zu verwandeln, ist ein zweites Projekt ähnlicher Größe.

Die fertige Alternative
Die Alternative dazu, Skripte zu betreuen, ist ein Service, der das Herunterladen als Schritt eins einer Wiederherstellung behandelt, nicht als die gesamte Aufgabe. Unser Restore-Dashboard beginnt mit einer kostenlosen Schätzung: exakte Anzahl archivierter Dateien, Gesamtgröße und ein fester Preis, bevor Sie einen Cent bezahlen. Von dort aus lädt es alles herunter, bereinigt es und kann direkt auf Ihr Hosting über SSH, FTP oder S3 bereitgestellt werden.
Die Details sind für diese spezifische Aufgabe gebaut. Sie bezahlen pro wiederhergestellter Datei, wobei die erste kostenlos ist. Wenn eine Wiederherstellung oder Bereitstellung fehlschlägt, geht die Rückerstattung automatisch auf Ihr Guthaben, kein Support-Ticket erforderlich. Wiederherstellungsoptionen entfernen Analysen und Werbung, schreiben Links auf relative Pfade um und erzwingen HTTPS. Bereitstellungen beinhalten ein kleines Ein-Datei-CMS mit eigenem generiertem Admin-Passwort, damit die wiederhergestellte Website bearbeitbar bleibt. Nirgendwo ein Abonnement: Sie laden ein Guthaben auf und geben es aus.
Wann ein Wayback Machine Downloader das falsche Werkzeug ist
Ein Downloader-Skript ist das richtige Werkzeug für Offline-Archive, Forschungsdatensätze und das Rettens eines Ordners alter PDFs. Es ist das falsche Werkzeug, wenn:
- Die Website wieder online gehen und dabei korrekt aussehen muss
- Die Person, die die Arbeit durchführt, niemals ein Terminal öffnen wird
- Das Archiv Zehntausende von URLs enthält, die Hälfte davon Abfragezeichenfolgen-Müll
- Es eine Frist gibt: ein Relaunch, eine rechtliche Anforderung, ein Kunde, der Ihnen auf die Füße tritt
Für diese Fälle ist das Skript nicht billiger als der Service. Es versteckt nur die Rechnung in Ihren Stunden. Eine Restorix-Schätzung sagt Ihnen zumindest den echten Preis im Voraus, bevor Sie ein Wochenende damit verbringen, es auf die harte Tour herauszufinden. Das macht die Skripte nicht schlecht. Es macht sie zu Werkzeugen mit einer Stellenbeschreibung, und die Stellenbeschreibung endet beim Ordner.
Wie wählt man
| Ihre Situation | Richtiges Werkzeug | Warum |
|---|---|---|
| Benötigen einen Snapshot als Referenz | Browser plus die id_-URL-Trick | Zwei Minuten, keine Installation |
| Kleine Site, vertraut mit CLI | wayback-machine-downloader-Gem | Kostenlos, bewährt, gute Filter |
| Bestimmte Dateien im Maßstab | CDX-API plus eigenes Skript | Volle Kontrolle über Filterung |
| Die Site muss wieder leben | Restorix | Download, Bereinigung und Bereitstellung in einem Auftrag |
Wählen Sie nach Ziel, nicht nach Download. Wenn ein Ordner mit Dateien das Ziel ist, verdienen die kostenlosen Tools ihren Platz und werden es immer tun. Wenn die Website selbst das Ziel ist, überspringen Sie die Ordnerstufe komplett und gehen Sie direkt zum Ding, das sie wieder aufbaut.
Stellen Sie Ihre Website aus der Wayback Machine wieder her
Kostenlose Schätzung in Sekunden — Sie zahlen erst bei Bestätigung. Fehlgeschlagene Wiederherstellungen werden automatisch erstattet.
FAQ
Gibt es einen offiziellen Wayback Machine Downloader?
Nein. Das Internet Archive betreibt die Wayback Machine und stellt die CDX-API bereit, liefert aber keinen offiziellen Massen-Downloader. Jedes Tool in diesem Bereich ist Drittanbieter und basiert auf denselben öffentlichen Endpunkten, die Sie selbst abfragen können.
Ist das wayback-machine-downloader Ruby-Gem sicher?
Es ist ein langlaufendes Open-Source-Projekt und im normalen Sinne sicher: Lesen Sie den Code, installieren Sie aus dem kanonischen Repository und seien Sie skeptisch gegenüber Paketen mit ähnlichen Namen. Das größere praktische Risiko ist ein veralteter Fork, der bei einer großen Site leise in der Mitte scheitert.
Warum ist mein Download in der Mitte stecken geblieben?
Fast immer Geschwindigkeitsbegrenzung. archive.org antwortet aggressiven Clients mit 429-Fehlern. Senken Sie die Parallelität, fügen Sie Verzögerungen zwischen Anfragen hinzu und setzen Sie fort. Die meisten Tools können dort aufhören, wo sie aufgehört haben, sodass ein Stau Zeit kostet, nicht Fortschritt.
Kann ein Downloader passwortgeschützte oder gelöschte Seiten abrufen?
Nein zu Passwörtern: Der Crawler kam nie über die Anmeldung hinaus, also gibt es nichts zum Herunterladen. Ja zu gelöschten Seiten: Die Löschung aus dem Live-Web ist genau das, wogegen das Archiv schützt, solange ein Crawl vor der Löschung stattfand.
Sind bezahlte Downloader-Apps besser als die kostenlosen Skripte?
Manchmal sind es die kostenlosen Skripte mit einer angebauten Oberfläche. Urteilen Sie nach Ausgabe, nicht nach Preis: Bekommen Sie originale id_-Dateien, sinnvolle Deduplizierung und saubere Links oder einen Ordner mit umgeschriebenem HTML? Ein Wiederherstellungsservice überspringt die Frage komplett, indem er Ihnen eine fertige Website übergibt, nicht Dateien.
Wie verwandle ich heruntergeladene Dateien wieder in eine funktionierende Website?
Entfernen Sie die Wayback-Umschreibungen, machen Sie interne Links relativ, wählen Sie einen kanonischen Host und stellen Sie dann bereit und testen Sie. Oder lassen Sie einen Wiederherstellungsservice alle vier für Sie erledigen, was der gesamte Grund dafür ist, dass diese Services existieren.
Verwandte Guides

wayback download
Wayback-Download: Alle Methoden nach Aufwand bewertet
Jede Wayback-Download-Methode nach Aufwand bewertet: einzelne Seiten, wget-Skripte, die CDX-API und automatisierte Dienste, die die gesamte Website für Sie wiederherstellen.

wayback machine download site
Eine komplette Website aus der Wayback Machine herunterladen
So laden Sie eine gesamte Website aus der Wayback Machine herunter: Fallstricke beim Crawlen, Query-String-Seiten, fehlende Assets und wann eine automatisierte Wiederherstellung DIY-Skripte schlägt.

restore website from wayback machine
Website aus der Wayback Machine wiederherstellen: Vollständige Anleitung
Website aus der Wayback Machine vollständig wiederherstellen: den richtigen Snapshot auswählen, Wiederherstellungsoptionen festlegen und dann eine funktionierende Website mit einem CMS in unter einer Stunde bereitstellen.
