So laden Sie von Archive.org herunter: Objekte, Snapshots und mehr
Von der Restorix-Redaktion · 28. April 2026 · 7 Min. Lesezeit

Stellen Sie Ihre Website aus der Wayback Machine wieder her
Kostenlose Schätzung in Sekunden — Sie zahlen erst bei Bestätigung. Fehlgeschlagene Wiederherstellungen werden automatisch erstattet.
Der Ausdruck 'Archive.org herunterladen' umfasst zwei völlig verschiedene Aufgaben, und sie zu verwechseln kostet schnell einen Nachmittag. Aufgabe eins: Dateien aus einem Objekt holen – ein Buch, ein Treiber, eine Konzertaufnahme. Aufgabe zwei: eine Website aus der Wayback Machine extrahieren. Die erste hat einen Download-Button. Die zweite ganz und gar nicht.
Ich mache beides wöchentlich, für Kundenwiederherstellungen und für Recherchen. Hier sind alle Methoden, die noch funktionieren, mit ehrlichen Abwägungen: was ein Klick ist, was eine Kommandozeile ist und was eine Falle im Gewand eines Download-Buttons.
Zwei Wege, um von Archive.org herunterzuladen
Archive.org speichert Inhalte als Objekte – in sich geschlossene Dateipakete mit Metadaten, wie ein beschrifteter Ordner im Regal. Die Wayback Machine speichert Captures – mit Zeitstempel versehene Kopien einzelner URLs, die gerendert und mit umgeschriebenen Links ausgeliefert werden. Objekte sind zum Herunterladen gemacht. Captures sind zum Betrachten im Browser gemacht.
Alles, was Sie tun können, ergibt sich aus dieser Trennung. Objekt-Downloads werden offiziell unterstützt: Buttons, Torrents, eine CLI, eine Metadaten-API. Snapshot-'Downloads' sind eigentlich Rekonstruktionen – Sie fragen die CDX-API, was existiert, holen die Original-Bytes jeder URL und reparieren dann die Links. Unterschiedliche Werkzeuge, unterschiedliche Fehlerquellen, unterschiedlicher Zeitaufwand.
Nicht sicher, in welcher Welt Sie sich befinden? Schauen Sie auf die URL. archive.org/details/etwas ist ein Objekt – herunterladbar. web.archive.org/web/2012/http://example.com ist ein Snapshot – betrachtbar. Dasselbe Archiv, zwei Adressschemata, zwei Regelwerke.
Archive.org-Objekte auf einfache Weise herunterladen
Stellen Sie Ihre Website aus der Wayback Machine wieder her
Kostenlose Schätzung in Sekunden — Sie zahlen erst bei Bestätigung. Fehlgeschlagene Wiederherstellungen werden automatisch erstattet.
Öffnen Sie eine beliebige Objektseite und schauen Sie auf die Download-Box rechts. Sie erhalten einzelne Dateien, meist einen Torrent-Link und manchmal eine ZIP- oder Volltext-Verknüpfung. Für ein PDF oder ein ISO klicken Sie auf die Datei. Fertig. Das ist der einzige Teil des Herunterladens von Archive.org, der so funktioniert, wie die Leute es erwarten.
- Klicken Sie auf 'SHOW ALL', um alle Dateien im Objekt zu sehen, einschließlich Logs und abgeleiteter Formate, die die Box verbirgt.
- Direkte URLs sind vorhersagbar: archive.org/download/{identifier}/{filename} – perfekt für Skripte und wget.
- Die Torrent-Option schlägt HTTP oft bei mehreren Gigabyte großen Objekten und setzt nach einem Verbindungsabbruch sauber fort.
- Derivate sind generierte Versionen – OCR-Text, kleinere MP4s. Der Original-Upload ist als solcher gekennzeichnet; greifen Sie zu diesem, wenn es auf Genauigkeit ankommt.
Noch ein Trick für Skripter: Hängen Sie /metadata/{identifier} an archive.org an und Sie erhalten eine JSON-Auflistung jeder Datei, ihrer Größe, Prüfsumme und ihres Formats. Genau dieses JSON konsumiert das Kommandozeilen-Tool unter der Haube.

Massen-Downloads mit der Internet Archive CLI
Für mehr als eine Handvoll Objekte installieren Sie das offizielle Kommandozeilen-Tool – das Python-Paket internetarchive, das den Befehl ia bereitstellt. Es kümmert sich um Authentifizierung, Fortsetzen und Wiederholungen und ist der Unterschied zwischen einem Skript und einem Wochenende voller Klicks.
- Installation: pip install internetarchive, dann führen Sie ia configure einmal mit Ihrem Account aus.
- Ein Objekt: ia download {identifier} spiegelt das gesamte Objekt in einen lokalen Ordner.
- Gezielt auswählen: ia download {identifier} --glob='*.pdf' – keine 40-GB-Überraschungen mehr.
- Ganze Suchen: ia search 'collection:archiveteam AND year:2013' --itemlist > list.txt, dann ia download in einer Schleife über diese Datei laufen lassen.
Es gibt Ratenbegrenzungen. Die CLI wiederholt von selbst höflich; Ihre rohe wget-Schleife gegen archive.org tut das nicht, und Hämmern führt zu Drosselung oder Sperrung. Seien Sie der Höfliche – das Archiv ist eine gemeinnützige Organisation, kein CDN.
So laden Sie Archive.org-Web-Snapshots herunter
Jetzt die schwierige Hälfte. Ein Wayback-Capture ist kein Objekt, daher gibt es keine Download-Box. Sie haben vier realistische Wege, nach Aufwand geordnet:
- Einzelne Seite, sofort: Öffnen Sie den Snapshot und nutzen Sie die Speichern-Funktion Ihres Browsers. Für eine Seite in Ordnung; die gespeicherte Kopie verweist bei ihren Assets weiterhin auf web.archive.org.
- Original-Bytes einer Datei: Fügen Sie id_ nach dem Zeitstempel in die Snapshot-URL ein – web.archive.org/web/20120501000000id_/http://example.com/style.css – und Sie erhalten die unveränderte Nutzlast. Ideal für einzelne Bilder, CSS und PDFs.
- Skriptgesteuerte Abrufe: Fragen Sie die CDX-API nach jeder erfassten URL unter einem Pfad ab und fordern Sie dann jede mit dem id_-Modifikator an. Funktioniert, aber Sie betreiben jetzt einen Scraper, deduplizieren Digests und schreiben Links selbst um.
- Downloader-Tools und Wiederherstellungsdienste: Community-Tools wie das wayback-machine-downloader-Gem automatisieren die CDX-plus-Abruf-Schleife; ein Wiederherstellungsdienst wie Restorix erledigt das plus die Bereinigung und Neubereitstellung.
Beachten Sie das Muster: Sobald Sie mehr als ein oder zwei Seiten wollen, schreiben oder betreiben Sie Werkzeuge. Daran ist nichts Verwerfliches – planen Sie es einfach ehrlich ein.
Eine Einschränkung zum id_-Trick, denn er verspricht zu viel: Er liefert die Original-Bytes dieser einen Antwort, aber er repariert nichts. Eine mit id_ geholte Seite enthält immer noch die absoluten URLs, die die Site 2012 verwendet hat, verweist immer noch auf Assets, die der Crawler nie erfasst hat, und setzt immer noch eine Domain voraus, die Ihnen vielleicht nicht mehr gehört. Original-Bytes sind das Ausgangsmaterial, nicht die fertige Website.

Objekte vs. Web-Snapshots: Wann welches zum Einsatz kommt
| Sie möchten | Verwenden Sie | Methode |
|---|---|---|
| Ein Buch, Lied, Treiber, ISO | Objekt | Download-Button, Torrent oder ia download |
| Eine alte Version einer Seite | Snapshot | Browser-Speichern oder id_-URL |
| Ein fehlendes Bild oder eine CSS-Datei | Snapshot | id_-URL direkt in wget |
| Eine ganze tote Website | Snapshot-Set | CDX-API plus Werkzeuge oder ein Wiederherstellungsdienst |
| Ein Dienst, der eingestellt wurde (GeoCities-Ära) | Objekt plus Snapshot | Archive Team WARCs, mit CDX abgeglichen |
Die letzte Zeile überrascht viele: Wenn das Archive Team einen sterbenden Host rettet, landet das Ergebnis als riesige WARC-Dateien im Objektarchiv. Dieselbe Website kann sowohl ein Objekt-Download als auch ein Satz Snapshots sein. Prüfen Sie zuerst die Objektseite – ein vorgepackter Crawl schlägt tausend einzelne Abrufe, und unser Formate-Guide erklärt, was mit diesen WARCs zu tun ist.
Download-Fehler, die Stunden kosten
- Rekursives wget gegen web.archive.org. Jeder Link wird umgeschrieben, um auf seiner Domain zu bleiben, sodass Ihr Crawler fröhlich die Benutzeroberfläche der Wayback Machine herunterlädt, bis zum Hitzetod des Universums.
- Das gesamte Objekt für eine Datei herunterladen. Ein Klick auf 'SHOW ALL' dauert zehn Sekunden; ein 40-GB-ZIP kostet Ihren Abend.
- Einem Snapshot als der ganzen Website vertrauen. Captures sind pro URL und opportunistisch – Bilder, die von einer CDN-Subdomain ausgeliefert werden, fehlen oft vollständig.
- Statuscodes in der CDX-Ausgabe ignorieren. Weiterleitungen und 404er werden ebenfalls archiviert; filtern Sie nach statuscode:200 und fassen Sie Digests zusammen, sonst stellen Sie Weiterleitungs-Stubs als Seiten wieder her.
- Die Prüfsummen überspringen. Objekte enthalten md5- und sha1-Dateien – überprüfen Sie große Downloads, bevor Sie darauf aufbauen.
- Annehmen, dass ein Snapshot-Datum ausreicht. Die Homepage von 2011 mit Bildern von 2009 ist normal; Websites wurden stückweise gecrawlt, also rechnen Sie damit, Capture-Daten zu mischen, um ein vollständiges Bild zu erhalten.
Sie haben die Dateien. Und jetzt?
Objekt-Downloads fügen sich direkt in Ihre Mediathek oder Toolchain ein – dieser Teil ist gelöst. Bei Snapshot-Abrufen beginnt die eigentliche Arbeit: umgeschriebene URLs, fehlende Assets, tote Kontaktformulare, gemischtes HTTP und HTTPS. Einen Ordner mit Captures von 2011 in eine tatsächlich ladende Website zu verwandeln, ist ein Wiederaufbau-Job, kein Download-Job.
An diesem Punkt habe ich aufgehört, Skripte von Hand zu schreiben, und verweise die Leute auf den Website-Restore-Service. Der kostenlose Kostenvoranschlag liest das Archiv für Sie aus – genaue Dateianzahl, Gesamtgröße, Festpreis – bevor Sie einen Cent ausgeben. Erste Datei kostenlos wiederhergestellt, danach pro Datei bezahlen, einmalige Aufladungen, kein Abonnement. Wenn eine Wiederherstellung oder Bereitstellung fehlschlägt, wird die Erstattung automatisch Ihrem Guthaben gutgeschrieben, kein Support-Ticket nötig.
Die Wiederherstellungsoptionen decken die kniffligen Teile ab, die Sie sonst skripten müssten: Analytics und Werbung entfernen, Links relativ machen, HTTPS erzwingen, www kanonisieren, Weiterleitungen beibehalten. Ein-Klick-Deployment schiebt das Ergebnis per SSH/SFTP, FTP oder S3, und das mitgelieferte Einzeldatei-CMS unter /webarchive-cms.php erlaubt es Ihnen, Inhalte direkt zu bearbeiten – das Tutorial führt durch einen kompletten Auftrag. Downloads beenden die Suche; sie beenden nicht die Arbeit.
Stellen Sie Ihre Website aus der Wayback Machine wieder her
Kostenlose Schätzung in Sekunden — Sie zahlen erst bei Bestätigung. Fehlgeschlagene Wiederherstellungen werden automatisch erstattet.
FAQ
Kann ich eine ganze Website von Archive.org herunterladen?
Nicht mit einem Button. Websites existieren auf der Wayback-Seite als Captures pro URL, daher bedeutet das Herunterladen einer Website, URLs über die CDX-API aufzulisten und jede einzelne abzurufen, dann die Links zu reparieren. Für alles, was über ein paar Seiten hinausgeht, verwenden Sie ein Downloader-Tool oder einen Wiederherstellungsdienst – wir vergleichen die Optionen in [ganze Website von Archive.org herunterladen](/de/download-entire-website-from-archive-org).
Ist es legal, von Archive.org herunterzuladen?
Gemeinfreie und Creative-Commons-Objekte sind ausdrücklich in Ordnung. Bei urheberrechtlich geschützten Objekten liegt die Entscheidung beim Rechteinhaber – Herunterladen für persönliche Recherchen wird im Allgemeinen toleriert, erneutes Veröffentlichen nicht. Die eigene alte Website aus ihren Captures wiederherzustellen, ist der klassische legitime Fall.
Was ist der Unterschied zwischen ia download und Torrents?
Dieselben Bytes, anderer Transport. Torrents glänzen bei riesigen Objekten und wackeligen Verbindungen; die CLI glänzt bei Skripting, --glob-Filterung und Stapelverarbeitung über viele Identifikatoren. Für ein einzelnes 200-MB-Objekt schlägt der einfache Download-Button beide.
Warum enthalten meine Snapshot-Downloads überall web.archive.org-URLs?
Die Wayback Machine schreibt Links um, damit Seiten in ihrem Player gerendert werden. Rufen Sie mit dem id_-Modifikator ab, um Original-Bytes zu erhalten, oder führen Sie eine Wiederherstellung durch, die Links zurückschreibt – die Option für relative Links von Restorix existiert genau für diese Bereinigung.
Wie lade ich eine ganze Sammlung statt eines einzelnen Objekts herunter?
Erstellen Sie die Objektliste mit ia search 'collection:name' --itemlist, dann führen Sie ia download pro Identifikator aus, mit --glob-Filtern, um nur die gewünschten Dateitypen zu behalten. Rechnen Sie damit, dass es eine Weile dauert – große Sammlungen gehen in die Terabytes, also prüfen Sie die Größenstatistiken der Sammlung, bevor Sie beginnen.
Verwandte Guides

archive org download
Archive.org Download-Formate: WARC, CDX und einzelne Dateien
Was jedes Archive.org-Downloadformat tatsächlich enthält, WARC-Aufzeichnungen, JSON-CDX-Indizes und einzelne Originaldateien, und was man damit macht.

download a website from archive org
So laden Sie eine Website von Archive.org herunter: 3 funktionierende Wege
Drei bewährte Wege, eine Website von archive.org herunterzuladen: Seiten manuell speichern, die CDX-API skripten oder eine automatisierte Wiederherstellung durchführen. Realistische Zeitangaben für jede Methode.

download entire website from archive org
Ganze Website von Archive.org herunterladen, nicht nur die Startseite
Um eine gesamte Website von archive.org herunterzuladen, benötigen Sie jede Seite, jedes Bild und jedes Stylesheet. Assets verstecken sich unter verschiedenen Zeitstempeln – hier erfahren Sie, warum, plus eine vollständige Checkliste.

wayback machine downloader
Wayback Machine Downloader Tools: Was wirklich funktioniert
Ein ehrlicher Blick auf Wayback Machine Downloader: die Open-Source-Skripte, ihre echten Grenzen und die fertige Lösung, die Ihre Website wieder online bringt.
