Archiveorg: dentro la più grande libreria gratuita di Internet
A cura di la redazione di Restorix · 31 maggio 2026 · 8 min di lettura

Ripristina il tuo sito dalla Wayback Machine
Stima gratuita in pochi secondi — paghi solo se confermi. I ripristini falliti vengono rimborsati automaticamente.
Chi scrive archiveorg come una parola sola di solito sa dove sta andando, solo che non sempre sa quanto materiale ci sia nell'edificio. La maggior parte arriva per il Wayback Machine e non si accorge neppure della biblioteca, dell'archivio dei concerti, dell'archivio delle notizie TV o del museo del software che gira nella scheda accanto. Capita. Ecco il tour completo, con i casi d'uso per chi gestisce siti web lasciati per ultimi, perché è lì che smette di essere intrattenimento e inizia a ripagarsi.
Cos'è davvero Archiveorg
Archiveorg, o, più correttamente, Archive.org, è il sito dell'Internet Archive, una biblioteca digitale no-profit fondata nel 1996 e con sede a San Francisco. La sua missione è "Accesso universale a tutta la conoscenza", e il sito è quella ambizione con una casella di ricerca: un account gratuito, nessun paywall, nessuna pubblicità, tutto aperto alla consultazione.
La home page è organizzata per tipo di media, web, testi, video, audio, software, immagini, ognuno con ricerca e filtri propri. Un account è facoltativo per navigare e obbligatorio per prendere in prestito libri o caricare contenuti. I fondi arrivano da donazioni, sovvenzioni e contratti di digitalizzazione con biblioteche: ecco perché il sito ogni tanto ti chiede di contribuire con qualche dollaro e per il resto ti lascia in pace.
Il Wayback Machine: la capsula del tempo del web di Archiveorg
Ripristina il tuo sito dalla Wayback Machine
Stima gratuita in pochi secondi — paghi solo se confermi. I ripristini falliti vengono rimborsati automaticamente.
Il pezzo forte. Il Wayback Machine conserva oltre 900 miliardi di pagine web catturate a partire dal 1996, la più grande registrazione pubblica di come appariva il web in un dato momento. Incolli un URL, ottieni un calendario di catture, clicchi una data e la pagina si carica com'era, banner pubblicitari rotti compresi.
Due funzioni pesano più di quanto sembri. Save Page Now, su web.archive.org/save, permette a chiunque di archiviare una pagina all'istante, usalo dopo lanci e migrazioni per fissare un record che controlli tu. E la ricerca URL con carattere jolly, web.archive.org/web/*/example.com, elenca gli indirizzi catturati sotto un dominio, ed è così che trovi pagine che avevi dimenticato esistessero. Per i meccanismi completi, trucchi del calendario, il modificatore id_ per i file grezzi, la vista Summary, leggi la guida al Wayback Machine.
Le catture, però, sono disomogenee. La home page di un quotidiano molto visitato può essere salvata migliaia di volte in un anno; il sito di una panetteria di quartiere, due volte. Le regole del robots.txt in passato hanno nascosto interi domini, e tutto ciò che sta dietro un login per il crawler non è mai esistito. Considera una cattura mancante come un dato inconcludente, non come la prova che una pagina non sia mai esistita.
Un avvertimento, detto chiaramente perché condiziona tutto il resto dell'articolo: il Wayback è un visualizzatore. Ti mostra le pagine. Non ti consegna un sito scaricabile.
Libri, audio e TV che puoi prendere in prestito gratis
La collezione di testi arriva a decine di milioni: libri scannerizzati, articoli accademici, riviste, manuali. Tramite Open Library puoi prendere in prestito libri moderni scannerizzati da un'ora a due settimane, e tutto ciò che è di pubblico dominio si scarica gratis in PDF, ePub o Kindle. Solo gli scaffali delle riviste, vecchie testate di informatica e videogiochi, interamente scannerizzate, valgono la visita.
Due angoli più silenziosi meritano una menzione: l'indice di articoli accademici per la ricerca open access, e l'archivio dei manuali, dove finisce la documentazione di qualsiasi elettrodomestico defunto tu abbia in garage.
L'audio è imperniato sul Live Music Archive, ben oltre centomila registrazioni di concerti, con la sezione dei Grateful Dead che è praticamente un'istituzione a sé. Aggiungi le vecchie radio drammatiche e i 78 giri digitalizzati e hai anni di ascolto. L'archivio TV News registra le trasmissioni e indicizza i sottotitoli, così puoi trovare ogni menzione di un argomento attraverso anni di copertura. Poi c'è la collezione Prelinger: migliaia di vecchi film educativi, industriali e pubblicitari, la fonte più pregiata di imbarazzo mid-century in tutto il web.

Un museo del software che puoi usare
La libreria software è la sorpresa dell'elenco: decine di migliaia di giochi MS-DOS, cabinati arcade, titoli per console e applicazioni storiche, tutti emulati nel browser. Niente installazioni, niente smanettamenti con i file di configurazione dell'emulatore, clicchi, aspetti qualche secondo e stai giocando al 1993. C'è anche software di produttività storico, che sembra noioso finché non ti serve aprire un formato file che niente di moderno legge più.
La collezione conta ben oltre la nostalgia. È un laboratorio di conservazione attivo, la dimostrazione che l'emulazione mantiene il software funzionante decenni dopo la morte dell'hardware. Blocca un pomeriggio: lo perderai comunque.
La sezione arcade fa notizia, centinaia di cabinati, ma le perle più silenziose sono le collezioni storiche di PC: fogli di calcolo d'epoca, strumenti di desktop publishing, interi sistemi operativi che avviano in una scheda del browser. Gli sviluppatori le usano per verificare come si comportavano i formati file antichi; tutti gli altri le usano per ricordare quanta pazienza avevano le persone un tempo.
Archiveorg per proprietari di siti e webmaster
Ora la parte che si ripaga da sola. Se gestisci siti web, Archiveorg è uno strumento operativo gratuito:
- Monitora la tua impronta. Controlla qualche volte all'anno la cronologia delle catture del tuo dominio. I buchi ti dicono quando i crawler non sono riusciti a raggiungerti, a volte il primo segnale visibile di un errore nel robots.txt o di un problema di hosting che nessuno ha segnalato.
- Fissa record con Save Page Now. Stai lanciando un restyling o migrando piattaforma? Salva gli URL chiave prima e dopo. Il tuo io futuro, nel mezzo di un incidente, ti sarà grato.
- Valuta i domini scaduti. Prima di comprare un dominio rilasciato, controlla cosa ospitava. Un dominio passato anni come fattoria di spam si porta dietro quella reputazione nel tuo progetto.
- Recupera contenuti persi. I backup falliscono; gli archivi ricordano. Testi e immagini recuperati da snapshot hanno salvato più di qualche pagina data per spacciata.
- Fai archeologia competitiva. Quando un rivale ha alzato i prezzi? Tolto una funzione? Cambiato brand? Le sue vecchie pagine sono datate e pubbliche.
Un'ultima cosa: le prove. Le catture con marca temporale vengono usate abitualmente per stabilire cosa dicesse una pagina in una certa data, in controversie, pratiche di rimozione e due diligence. Screenshot della barra con la marca temporale, non solo della pagina.
Ottenere file reali da Archiveorg
Visualizzare non è recuperare. Se il compito è "ricostruisci questo sito", un negozio WooCommerce di un cliente il cui hosting è stato cancellato, un forum di comunità abbandonato dall'admin, ti serve l'estrazione. Il servizio di ripristino è fatto esattamente per questo: estrae la copia archiviata di un dominio dal Wayback Machine e te la restituisce come file funzionanti.
- Parti dal preventivo gratuito: numero esatto di file archiviati, dimensione totale e prezzo bloccato. Sai il costo prima di spendere un centesimo.
- Scegli un intervallo di date di cattura e le opzioni di pulizia, rimuovi vecchi script analytics, pubblicità, iframe e link esterni, minifica gli asset, rendi relativi i link interni, forza HTTPS, mantieni i redirect.
- Paga per file ripristinato; il primo file è gratis. Ricarica il saldo una volta, niente rinnovi automatici, e i ripristini falliti vengono rimborsati in automatico.
- Scarica il risultato, esporta gli articoli come XML, CSV o JSON con un manifest completo dei file, oppure distribuisci sul tuo server in un clic. Il CMS Restorix integrato ti permette di modificare i contenuti ripristinati senza toccare codice.
Per i dettagli sul recupero di domini, domini scaduti, host defunti, siti con asset mancanti, la guida al recupero di vecchi siti web approfondisce il tema, e il tutorial mostra un ripristino completo dal preventivo al deploy.

Cosa non può fare la libreria per te
Un elenco breve e onesto. Non è il tuo backup: la frequenza di crawl è fuori dal tuo controllo, e i siti moderni pesantemente JavaScript vengono catturati male. Non c'è una ricerca full-text su tutto il web archive, solo URL, non il testo delle pagine. I contenuti dietro login o paywall non sono mai stati crawlati. I proprietari dei siti possono chiedere l'esclusione, quindi alcuni domini semplicemente non ci sono. E sul fronte web non c'è un download massivo, che vale la pena ripetere perché è la domanda con cui arrivano tutti.
Niente di tutto ciò intacca il valore. È una biblioteca pubblica gratuita che custodisce una memoria del web su scala petabyte, gestita da una no-profit con un budget che farebbe vergognare una startup di medie dimensioni. Trattala come il primo posto in cui guardare, e sappi dove andare quando guardare non basta più.
Ripristina il tuo sito dalla Wayback Machine
Stima gratuita in pochi secondi — paghi solo se confermi. I ripristini falliti vengono rimborsati automaticamente.
FAQ
Archiveorg è gratuito?
Sì. Consultare ogni collezione è gratis, gli account sono gratis e non esiste un piano premium. L'Internet Archive è una no-profit finanziata dalle donazioni; ogni tanto chiederà un contributo, mai un abbonamento.
Mi serve un account per usare Archiveorg?
Solo per prendere in prestito libri, caricare i tuoi file o per funzioni extra come la cattura degli outlink di Save Page Now. Tutto il resto, il Wayback Machine, l'emulatore software, le registrazioni dei concerti, funziona senza alcun login.
È legale usare Archiveorg?
Sì. Opera come una biblioteca: archivia pagine web pubbliche, digitalizza opere di pubblico dominio e presta libri scannerizzati un lettore alla volta tramite il controlled digital lending. Alcune delle sue pratiche di prestito sono state contestate in tribunale dagli editori, ma leggere, ascoltare e fare ricerca sul sito è senza dubbio lecito.
Come trovo il mio vecchio sito su Archiveorg?
Vai su web.archive.org e incolla il dominio. Il calendario mostra ogni cattura registrata. Per elencare le pagine sotto il dominio, usa la ricerca con carattere jolly: web.archive.org/web/*/tuodominio.com.
Posso scaricare un intero sito da Archiveorg?
Non dal Wayback Machine stesso, le catture sono in sola visualizzazione, senza esportazione massiva. Un servizio di ripristino come Restorix estrae i file archiviati, li ripulisce e confeziona il sito per il download o il redeploy sul tuo hosting.
Archiveorg ha un'API?
Sì. Ci sono API pubbliche per i metadati degli item e per la ricerca avanzata nelle collezioni, più la CDX API del Wayback Machine, che elenca ogni cattura di un URL. Anche Save Page Now ha un'API, per l'archiviazione automatizzata.
Guide correlate

internet archive way back machine
Internet Archive Way Back Machine: Guida per Webmaster
Come funziona Internet Archive Way Back Machine, l'organizzazione no-profit che lo gestisce, cosa significano oltre 900 miliardi di pagine archiviate, e come i webmaster lo utilizzano quotidianamente.

wayback machine archive org
Wayback Machine su Archive.org: una guida pratica al sito
Un tour pratico della Wayback Machine su Archive.org: dove si trova, come funzionano realmente la casella di ricerca e il calendario, e come andarsene con file reali.

archive org download
Formati di download di Archive.org: WARC, CDX e file singoli
Cosa contiene davvero ogni formato di download di Archive.org, acquisizioni WARC, indici CDX in JSON e singoli file originali, e cosa farne.

old website recovery
Recupero di vecchi siti web: rimettere online un sito dopo anni di inattività
Il recupero di vecchi siti web spiegato: cosa sopravvive in archivi e backup dopo anni di inattività, cosa è perso per sempre e come ricostruire passo dopo passo.
