Archive.org-Website: Erweiterte Suche, Filter & Sammlungen
Von der Restorix-Redaktion · 26. April 2026 · 7 Min. Lesezeit

Stellen Sie Ihre Website aus der Wayback Machine wieder her
Kostenlose Schätzung in Sekunden — Sie zahlen erst bei Bestätigung. Fehlgeschlagene Wiederherstellungen werden automatisch erstattet.
Die meisten Menschen besuchen die Archive.org-Website genau einmal. Sie fügen eine tote URL in die Wayback Machine ein, machen einen Screenshot und gehen. Das ist eine Verschwendung eines ernsthaften Tools. Hinter demselben Login verbirgt sich eine vollständige digitale Bibliothek – zig Millionen Einträge – mit eigener Suchmaschine, Abfragesyntax und Filtern, die fast niemand nutzt.
Ich hole seit Jahren Kundenseiten, tote Software und gescannte Handbücher aus Archive.org. Der Unterschied zwischen dem Finden in zwei Minuten und dem Aufgeben nach zwanzig ist selten Glück. Es ist das Wissen, welche Suchbox man benutzt und welchen Filter man klickt. Das ist der Workflow, den ich tatsächlich befolge.
Was die Archive.org-Website tatsächlich indiziert
Hier beginnt die Verwirrung. Archive.org betreibt zwei verschiedene Systeme mit demselben Logo. Das Element-Archiv – wonach Sie auf der Startseite suchen – enthält hochgeladene und gecrawlte Objekte: Bücher, Konzerte, Software, Videos, Radiosendungen. Jedes Element hat Metadaten, eine Dateiliste und Bewertungen. Die Wayback Machine unter web.archive.org speichert Webseiten-Snapshots, indiziert nach URL. Über 900 Milliarden davon.
Warum ist das für alte Websites wichtig? Weil eine tote Seite an beiden Orten auftauchen kann, unterschiedlich. Die Wayback-Seite hat die Seiten. Die Element-Seite kann einen Archive Team Rettungs-Crawl des gesamten Dienstes enthalten, auf dem Ihre Seite lief – GeoCities, FortuneCity, MobileMe – als herunterladbare WARC-Dateien gepackt. Wenn Sie nur eine Tür benutzen, verpassen Sie die andere.
- Texte: gescannte Bücher, Handbücher, Zeitschriften – volltextdurchsuchbar
- Software: alles von Shareware-CDs bis zu alten Browsern und Flash-Projektoren
- Audio und Video: Live-Konzerte, Radioarchive, Nachrichtenreihen, Werbespots
- Web-Elemente: Crawl-Sammlungen und Archive Team-Erfassungen, gespeichert als WARC-Dateien
- Bilder und Daten: Fotosammlungen, Kartenscans, Forschungsdatensätze
Erweiterte Suche auf der Archive.org-Website
Stellen Sie Ihre Website aus der Wayback Machine wieder her
Kostenlose Schätzung in Sekunden — Sie zahlen erst bei Bestätigung. Fehlgeschlagene Wiederherstellungen werden automatisch erstattet.
Das Feld auf der Startseite reicht für Beatles-Bootlegs. Für alles Präzise gehen Sie zur erweiterten Suchseite – archive.org/advancedsearch.php – oder schreiben Sie die Abfrage selbst. Die Syntax ist Lucene-ähnlich und streng: Feldnamen sind klein geschrieben, Bereiche verwenden eckige Klammern und boolesche Operatoren müssen groß geschrieben sein. Wenn Sie einen davon falsch machen, erhalten Sie leise Müllresultate.
Eine Abfrage, die Joomla-bezogene Software findet, die zwischen 2005 und 2010 hinzugefügt wurde, sieht so aus: title:(joomla) AND mediatype:software AND date:[2005-01-01 TO 2010-12-31]. Fügen Sie sie in die Suchbox ein, und sie funktioniert einfach. Kein Formular erforderlich.
- identifier: – der genaue URL-Slug des Elements; die schnellste Recherche überhaupt
- collection: – Einschränkung auf eine Sammlung, z.B. collection:archiveteam
- creator: und title: – unscharf, aber nützlich mit Anführungszeichen um Phrasen
- date:[YYYY-MM-DD TO YYYY-MM-DD] – Hinzufügungszeitraum, nicht Erstveröffentlichung
- mediatype: – texts, software, audio, movies, image, web, data
- NOT, AND, OR und Klammern – frei kombinierbar, aber groß schreiben
Ein Stolperstein: date: filtert, wann das Element ins Archiv kam, nicht wann der Inhalt erstellt wurde. Ein 2003er Handbuch, hochgeladen 2019, entspricht 2019.

Filter, die die schwere Arbeit erledigen
Sobald die Ergebnisse geladen sind, spart die linke Seitenleiste Zeit. Sie können nach Medientyp, Jahr, Sammlung, Ersteller und Sprache filtern und nach Relevanz, Aufrufen (gesamt oder wöchentlich), Hinzufügungsdatum oder Titel sortieren. Die meisten Suchen scheitern nicht, weil das Material fehlt, sondern weil es auf Seite neun hinter zweihundert Podcast-Folgen liegt. Filter beheben das.
- Filtern Sie zuerst nach Medientyp. Die Suche nach einem eingestellten CMS in allem erstickt Sie in Audio.
- Sortieren Sie nach wöchentlichen Aufrufen, wenn Sie gepflegtes Material wollen – die Menge ist ein guter Qualitätsindikator.
- Stapeln Sie Sammlungs- und Jahresfilter, um zu rekonstruieren, wie ein Stück des Internets zum Beispiel 2008 aussah.
| Filter | Beste Verwendung |
|---|---|
| Medientyp | 90% des Rauschens mit einem Klick entfernen |
| Jahr | Eine Zeitleiste um die Lebensdauer einer Seite herum aufbauen |
| Sammlung | In einem vertrauenswürdigen Crawl oder Rettungsprojekt bleiben |
| Ersteller / Hochlader | Dem vollständigen Set eines Archivars folgen |
| Wöchentliche Aufrufe | Elemente erkennen, die Menschen noch aktiv nutzen |
Sammlungen, die Sie für alte Websites kennen sollten
Sammlungen sind kuratierte Regale, und einige davon sind Gold für jeden, der alten Websites nachjagt:
- archiveteam – panische, liebevolle Erfassungen sterbender Dienste: GeoCities, FortuneCity, Posterous, MobileMe. Oft vollständige WARC-Crawls ganzer Hosting-Plattformen.
- geocities und seine Spiegelungen – die Yahoo! GeoCities-Rettung, die größte einzelne Wiederherstellung persönlicher Webseiten, die je durchgeführt wurde.
- widecrawl und andere Crawl-Sammlungen – Massen-Internet-Archive-Crawls, nützlich, wenn die Wayback-per-URL-Ansicht Lücken hat.
- Softwarebibliothek-Sammlungen – alte Browser, Flash, Shockwave, Java-Applets. Sie brauchen diese, um tatsächlich auszuführen, was alte Seiten ausgeliefert haben.
- cd-rom software library – Shareware-Discs voller zeitgenauer Website-Baukästen, Zähler und Gästebuch-Skripte.
Beginnen Sie auf der Sammlungsseite, nicht in der Suchbox. Die Betreuer dokumentieren in der Regel, was drin ist, wie es gecrawlt wurde und was die Dateistruktur bedeutet – Kontext, der Sie davor bewahrt, um 2 Uhr morgens zu raten.

Archive.org-Website vs. Wayback Machine: Welche Tür benutzen?
| Archive.org Element-Suche | Wayback Machine | |
|---|---|---|
| Sie suchen nach | Elementen über Metadaten | URLs über Adresse |
| Sie erhalten | Herunterladbare Dateien | Gerenderte Snapshots |
| Am besten geeignet für | Software, Medien, Massencrawls | Seiten einer bestimmten Website |
| Schwäche | Keine Seitendarstellung | Kein offizieller Download der gesamten Seite |
Faustregel: Wenn Sie die URL benennen können, beginnen Sie in der Wayback Machine. Wenn Sie das Ding nur beschreiben können – dieses phpBB-Theme, das 2007 jeder benutzte – gewinnt die Element-Suche. Für eine vollständige Wiederherstellung nutzen Sie am Ende meist beides: Crawls und CDX-Daten von der Element-Seite, Seiten-Snapshots von der Wayback-Seite.
Ein realer Workflow: Das tote Forum eines Kunden jagen
Konkreter Fall. Das phpBB-Forum eines Kunden von 2009 verschwand, als der Hoster 2014 zusammenbrach. Die Domain lag jahrelang geparkt; sie wollten den Inhalt zurück. Hier ist die Reihenfolge, die funktionierte:
- Wayback-CDX-Abfrage für die Domain, um zu kartieren, welche URLs erfasst wurden und wann – etwa 1.400 Erfassungen, die meisten von 2010 bis 2012.
- Element-Suche nach Domain und Seitenname innerhalb von collection:archiveteam – diesmal nichts, aber es ist eine Dreißig-Sekunden-Prüfung.
- Sammlungsprüfung beim alten Hoster – der Hoster selbst war teilweise von Archive Team erfasst worden, was mehrere Vorlagen- und Bildlücken füllte.
- Jahresgefilterte Suche nach der Software des Forums, um ein zeitgenaues phpBB-Paket als Referenz zu holen.
Gesamtzeit: etwa vierzig Minuten, die meiste davon mit dem Lesen der CDX-Ausgabe. Das Suchen ist der einfache Teil, wenn man die Türen kennt. Beachten Sie, was nicht passiert ist: kein Raten bei Google Cache, kein Betteln im Support-Posteingang des alten Hosters, noch kein Geld bezahlen. Das Archiv sagte uns genau, was überlebt hat – 1.400 Erfassungen, eine bekannte Lücke 2013 und ein teilweiser Rettungscrawl, um sie zu flicken. Dieselben CDX-Daten sind es, die eine Restorix-Schätzung liest, um Dateien zu zählen und eine Wiederherstellung zu bepreisen, wo diese Geschichte unten weitergeht.
Wenn die Archive.org-Website nicht ausreicht
Alles oben findet Material. Es liefert Ihnen aber keine funktionierende Website. Wayback-Snapshots kommen mit umgeschriebenen URLs, fehlenden Bildern, toten Formularen und absoluten Links, die auf eine Domain zeigen, die Sie nicht mehr kontrollieren. Eine Seite aus rohen Erfassungen von Hand neu zu bauen, sind Tage mit sed-Skripten und Reue.
Diese Lücke ist genau das, wofür Restorix gebaut wurde. Fügen Sie die URL ein, und die kostenlose Schätzung zeigt die genaue Anzahl archivierter Dateien, die Gesamtgröße und einen festen Preis, bevor Sie etwas bezahlen. Wiederherstellungen können Analytics und Werbung entfernen, Links in relative umwandeln, HTTPS erzwingen und direkt auf Ihren VPS, FTP-Hosting oder S3 bereitstellen – mit einem Eindatei-CMS inklusive, damit Sie den wiederbelebten Inhalt bearbeiten können.
Nutzen Sie die Archive.org-Website zum Kundschaften: Überprüfen Sie, was existierte, wann und wie viel davon überlebte. Lassen Sie dann die Werkzeuge die Rekonstruktion übernehmen. Ihre Zeit ist mehr wert als ein Wochenende mit WARC-Parsing.
Stellen Sie Ihre Website aus der Wayback Machine wieder her
Kostenlose Schätzung in Sekunden — Sie zahlen erst bei Bestätigung. Fehlgeschlagene Wiederherstellungen werden automatisch erstattet.
FAQ
Ist die Archive.org-Website kostenlos nutzbar?
Ja. Suchen, Streamen und Herunterladen öffentlicher Elemente kostet nichts, und kein Konto wird zum Browsen benötigt. Ein kostenloses Konto fügt Favoriten, Uploads und Listen hinzu. Das Ausleihen bestimmter moderner Bücher erfordert ein Konto, aber alles, was in diesem Leitfaden abgedeckt ist, ist offen.
Was ist der Unterschied zwischen der Archive.org-Website und der Wayback Machine?
Archive.org ist die übergeordnete digitale Bibliothek: Elemente wie Bücher, Software, Audio und Crawl-Sammlungen, durchsuchbar nach Metadaten. Die Wayback Machine ist ein Dienst darin, der über 900 Milliarden Webseiten-Snapshots speichert, indiziert nach URL. Alte Websites können in beiden erscheinen – als Wayback-Snapshots und als Massencrawl-Elemente.
Kann ich alte Webseiten auf Archive.org volltextdurchsuchen?
Nein. Die Wayback Machine indiziert nach URL, nicht nach Seitentext – Sie brauchen die Adresse, nicht Stichworte. Volltextsuche funktioniert nur innerhalb von Textelementen wie gescannten Büchern. Für Seiten finden Sie zuerst die URL (alte Links, Suchmaschinen, CDX-Wildcards), und schlagen Sie sie dann nach.
Wie lade ich etwas herunter, das ich auf der Archive.org-Website finde?
Jede Elementseite hat eine Download-Box mit einzelnen Dateien sowie Torrent- und Gesamtelement-Optionen. Für von der Wayback Machine erfasste Websites gibt es keinen Download-Button – das erfordert die CDX-API, ein Download-Tool oder einen Wiederherstellungsdienst wie Restorix. Unser Leitfaden zum [Herunterladen von Archive.org](/de/download-archive-org) beschreibt jede Methode.
Warum kann ich eine bestimmte alte Seite überhaupt nicht finden?
Drei übliche Gründe: Die robots.txt der Seite hat Crawler blockiert, die Seite wurde nirgendwo verlinkt, wohin ein Crawler folgte, oder alles befand sich hinter einem Login oder starkem Flash und JavaScript. Überprüfen Sie die CDX-API für die nackte Domain, bevor Sie aufgeben – Erfassungen verstecken sich manchmal unter seltsamen Subdomains oder einer www-Variante, die Sie vergessen haben.
Verwandte Guides

wayback machine archive org
Wayback Machine auf Archive.org: Ein praktischer Leitfaden
Ein praxisnaher Rundgang durch die Wayback Machine auf Archive.org: wo sie zu finden ist, wie Suchfeld und Kalender wirklich funktionieren und wie man am Ende mit echten Dateien dasteht.

archiveorg
Archiveorg: Ein Blick in die größte kostenlose Bibliothek des Internets
Archiveorg ist mehr als die Wayback Machine: kostenlose Bücher, Live-Musik, TV-Nachrichten, spielbare Software und über 900 Milliarden Webseiten. Komplette Tour plus Dateiwiederherstellung.

download archive org
So laden Sie von Archive.org herunter: Objekte, Snapshots und mehr
Alle praktischen Möglichkeiten, Inhalte von Archive.org herunterzuladen – Objektdateien, Massenabrufe per CLI und Wayback-Web-Snapshots – und wie Sie die richtige für Ihre Aufgabe auswählen.

archive org download
Archive.org Download-Formate: WARC, CDX und einzelne Dateien
Was jedes Archive.org-Downloadformat tatsächlich enthält, WARC-Aufzeichnungen, JSON-CDX-Indizes und einzelne Originaldateien, und was man damit macht.
