Recupero di vecchie pagine web: i modi più veloci per trovare una pagina scomparsa
A cura di la redazione di Restorix · 21 maggio 2026 · 7 min di lettura

Ripristina il tuo sito dalla Wayback Machine
Stima gratuita in pochi secondi — paghi solo se confermi. I ripristini falliti vengono rimborsati automaticamente.
Qualcuno ti invia un link. Ci clicchi sopra e invece della pagina trovi un 404, o peggio, un dominio parcheggiato pieno di pubblicità di pillole e criptovalute. La pagina esisteva l'anno scorso. Lo sai che esisteva. Potresti averla citata. Il recupero di vecchie pagine web è l'arte di recuperare quella singola pagina e, a differenza del restauro di un intero sito, di solito è un lavoro di dieci minuti se bussi alle porte giuste nell'ordine giusto.
Questo è l'ordine che uso io, dal più veloce per primo, con i tassi di successo che vedo effettivamente. La buona notizia: per una pagina pubblica vissuta più di qualche mese, le probabilità sono fortemente a tuo favore.
Recupero di vecchie pagine web: prova prima la fonte più veloce
La mossa più rapida nel recupero di vecchie pagine web non costa nulla e richiede cinque secondi. Incolla l'URL morto nella barra degli indirizzi del Wayback Machine, o usa il collegamento web.archive.org/web/ seguito dall'URL, e ottieni un calendario di ogni istantanea mai scattata. Scegli una data, ottieni la pagina. Per le pagine che sono state pubbliche per un anno o più, funziona circa otto volte su dieci nella mia esperienza.
Se sai approssimativamente quando la pagina era viva, aggiungi un anno al collegamento: web.archive.org/web/2019/ seguito dall'URL salta direttamente alla cattura più vicina del 2019 invece di farti scorrere il calendario. Un piccolo trucco, ma un vero risparmio di tempo quando controlli dozzine di URL di fila.
Wayback Machine: la spina dorsale del recupero di vecchie pagine web
Ripristina il tuo sito dalla Wayback Machine
Stima gratuita in pochi secondi — paghi solo se confermi. I ripristini falliti vengono rimborsati automaticamente.
Il Wayback Machine è dove iniziano e finiscono la maggior parte dei recuperi di singole pagine, quindi impara le sue due peculiarità. Primo, il calendario segna le date di cattura con cerchi, cerchi più grandi, più catture quel giorno, e gli anni sani sono quelli da sfruttare, non l'anno in cui il dominio è morto. Le ultime catture di un sito morente sono di solito pagine di parcheggio. Secondo, ciò che ottieni è un'istantanea: le immagini vengono caricate da copie archiviate, i link puntano ad altre pagine archiviate e il modulo di contatto ora non fa nulla.
Altre due mosse utili. La vista Changes evidenzia ciò che differiva tra le catture, utile quando hai bisogno della versione prima che qualcuno modificasse la parte per cui eri venuto. E se Wayback non ha nulla, non fermarti lì. È il più grande archivio, non l'unico.
archive.today: il piano di backup che spesso vince
archive.today, raggiungibile anche come archive.ph, archive.li e una manciata di altri mirror, è un animale diverso. Salva le pagine su richiesta invece di eseguire la scansione programmata, non rispetta le stesse richieste di esclusione e contiene regolarmente pagine che Wayback si è perso completamente. Cerca l'URL sulla sua pagina principale: se qualcuno, da qualche parte, ha mai incollato quel link nella sua casella di salvataggio, l'istantanea è lì.
Le sue catture gestiscono meglio anche le pagine moderne. Esegue il rendering di JavaScript prima di salvare, quindi le pagine che appaiono come gusci vuoti su Wayback a volte tornano complete. Il compromesso è che tutto è manuale, una pagina alla volta, va bene per una singola pagina, fastidioso per cinquanta.
Cosa è successo alla cache di Google e di Bing
Per vent'anni la risposta più veloce a 'la pagina non c'è più' è stata la copia cache di Google. È finita a febbraio 2024, quando Google ha ritirato l'operatore di ricerca cache: e ha rimosso i link Cached dai risultati. La motivazione ufficiale era che le pagine ora si caricano in modo abbastanza affidabile che nessuno ne ha bisogno, magro conforto mentre fissi un 404.
Bing ha mantenuto un link alla pagina cache più a lungo, nascosto nel menu accanto a ogni risultato, ma lo sta eliminando gradualmente. Se ne vedi ancora uno, usalo finché dura. Le cache dei motori di ricerca hanno comunque sempre conservato solo la scansione più recente, il che le rende inutili per una pagina scomparsa anni fa, ma per una pagina eliminata martedì scorso, possono essere l'unica copia mai esistita.
Posti che le persone dimenticano di controllare
- Citazioni di Wikipedia. Se la pagina è mai stata citata su Wikipedia, la citazione di solito include un collegamento 'archiviato dall'originale' a un'istantanea. Controlla anche la cronologia delle modifiche dell'articolo.
- Common Crawl. Un dataset di crawl pubblico gratuito su index.commoncrawl.org. HTML grezzo, nessuna bella interfaccia, scomodo da interrogare, e pagine che nessun altro ha conservato.
- Lettori RSS. Feedly, Inoreader e compagni memorizzano il testo degli articoli recuperati. Se la pagina era un post di un blog con un feed, il suo testo completo potrebbe trovarsi in questo momento nei lettori di estranei.
- Il tuo browser. Se hai visitato la pagina di recente, la cronologia conferma l'URL esatto e un ricaricamento a volte estrae la pagina dalla cache del disco prima che arrivi il 404. Basse probabilità, costo zero.
- App di lettura differita. Salvataggi su Pocket e Instapaper, i tuoi o quelli dell'autore.
- L'autore. Una breve email, 'Ho citato il tuo articolo, hai ancora una copia?', funziona più spesso di quanto si pensi.

Recupero di vecchie pagine web quando non è stato archiviato nulla
A volte la risposta onesta è che non esiste alcuna istantanea: la pagina era troppo nuova, il sito bloccava i crawler o viveva dietro un login. Il recupero di vecchie pagine web non è finito a quel punto, ma gli strumenti passano dagli archivi alla forensica.
Cerca frasi distintive dalla pagina tra virgolette, i siti che hanno sindacato, citato o copiato apertamente il contenuto emergeranno e potrai ricostruire la sostanza dai loro. Cerca solo il titolo della pagina: i redesign spostano i contenuti su nuovi URL in continuazione senza informare nessuno, e la pagina 'eliminata' spesso vive a un nuovo indirizzo sullo stesso sito. Cerca versioni PDF o cartacee; i contenuti di documentazione e accademici in particolare tendono ad averne una. E controlla chi ha linkato: un blogger che ha riassunto la pagina in dettaglio ha già fatto metà della tua ricostruzione.
Recupero di vecchie pagine web: quale fonte provare per prima
| La tua situazione | Prova prima | Poi | Da sapere |
|---|---|---|---|
| Pagina pubblica, online da un anno o più | Wayback Machine | archive.today | Il tasso di successo più alto di qualsiasi percorso |
| Pagina eliminata nelle ultime settimane | Link cache di Bing | Common Crawl | Potrebbe non essere stato ancora scansionato dagli archivi |
| Sito che bloccava crawler o archiviazione | archive.today | Ricerca di frasi tra virgolette | Servizi diversi applicano esclusioni diverse |
| Hai bisogno solo di un dato o di una citazione | Ricerca di frasi tra virgolette | Citazioni di Wikipedia | I frammenti spesso rispondono direttamente alla domanda |
| Hai visitato tu stesso la pagina di recente | Cronologia e cache del browser | App RSS o di lettura differita | Conferma l'URL esatto prima di tutto |
Con questa tabella, una pagina è un lavoro di dieci minuti. Venti pagine dello stesso sito non sono più recupero di vecchie pagine web, è un ripristino del sito. Quando arrivi a quel punto, smetti di recuperare URL uno alla volta e ripristina in blocco: questo servizio di ripristino offre un preventivo gratuito con il conteggio esatto dei file archiviati prima di spendere qualsiasi cosa, il che ti dice anche se vale la pena ripristinare il sito. Se l'intero sito è scomparso, vedi recupero di vecchi siti web per la versione per intero sito di questo manuale.
Salva la pagina correttamente questa volta
Qualunque cosa recuperi, presupponi che possa scomparire di nuovo, gli archivi hanno lacune, le regole di esclusione cambiano, i servizi vanno e vengono. Salva la pagina in tre modi, adesso. Invia l'URL vivo a Save Page Now del Wayback Machine in modo che esista una nuova istantanea secondo il tuo programma. Invia ad archive.today come seconda copia indipendente. E conserva una copia locale che nessun servizio controlla: una stampa in PDF o un salvataggio HTML in un unico file dal tuo browser. Tre copie in tre sistemi sembra paranoico fino al giorno in cui sembra ovvio.
Se la pagina recuperata è tua e sta per tornare online, la stessa logica si applica: ripristina il sito correttamente, mantieni i file modificabili e non dipendere mai più dalla memoria di un crawler per i tuoi contenuti. Il tutorial di Restorix illustra un ripristino completo se vuoi vedere il processo prima di impegnarti.

Ripristina il tuo sito dalla Wayback Machine
Stima gratuita in pochi secondi — paghi solo se confermi. I ripristini falliti vengono rimborsati automaticamente.
FAQ
La cache di Google esiste ancora?
No. Google ha ritirato la sua funzione di pagina cache a febbraio 2024, sia l'operatore di ricerca cache: sia i collegamenti Cached nei risultati sono spariti. Bing mostra ancora un collegamento alla pagina cache su alcuni risultati tramite il menu accanto a ogni elenco, ma lo sta eliminando gradualmente. Per qualsiasi cosa più vecchia di qualche settimana, vai direttamente al Wayback Machine.
Posso recuperare una vecchia pagina web che non è mai stata archiviata da nessuna parte?
A volte, parzialmente. Le ricerche di frasi tra virgolette trovano copie sindacate e citazioni, le citazioni di Wikipedia spesso linkano a istantanee che ti sei perso e l'autore potrebbe ancora avere l'originale. Di solito ricostruirai la sostanza piuttosto che la pagina esatta, e alcune pagine sono semplicemente scomparse.
Come posso vedere una pagina come appariva in una data specifica?
Usa il calendario del Wayback Machine: incolla l'URL, clicca un anno, poi clicca una data evidenziata. Il collegamento web.archive.org/web/2019/ seguito dall'URL salta all'istantanea più vicina a quella data. Le istantanee preservano l'HTML e le immagini di quel giorno, inclusi i collegamenti.
Perché Wayback dice che una pagina è stata bloccata o esclusa?
Di solito robots.txt, il sito ha bloccato i crawler a un certo punto e l'archivio lo ha rispettato. Prova invece archive.today, poiché applica regole diverse, o Common Crawl per l'HTML grezzo.
Il recupero di vecchie pagine web è legale?
Visualizzare e salvare copie archiviate per riferimento, citazione o ricerca è una pratica normale. Ripubblicare la pagina recuperata di qualcun altro come tuo contenuto è dove scatta il copyright. Recupera per riferimento e citazione, o recupera le tue pagine direttamente.
Guide correlate

web cache
Web Cache spiegata: come funzionano le cache e come usarle
Cos'è una web cache, come funzionano le cache di browser, CDN, motori di ricerca e archivi, e come usare una web cache per visualizzare una pagina scomparsa.

wayback machine
Wayback Machine: la guida completa alla storia del web
Il Wayback Machine archivia oltre 900 miliardi di pagine web. Scopri come funzionano le scansioni, le istantanee, il calendario e la sintassi di ricerca, e come ripristinare un sito perso.

restore deleted site
Ripristinare un sito eliminato: cosa fare nelle prime 48 ore
Il tuo hosting ha eliminato il tuo sito? Segui questo piano di triage di 48 ore, poi ripristina il sito eliminato dagli archivi web passo dopo passo.

old website recovery
Recupero di vecchi siti web: rimettere online un sito dopo anni di inattività
Il recupero di vecchi siti web spiegato: cosa sopravvive in archivi e backup dopo anni di inattività, cosa è perso per sempre e come ricostruire passo dopo passo.
