Wayback Machine del tempo: snapshot, timestamp e lacune di acquisizione
A cura di la redazione di Restorix · 3 giugno 2026 · 8 min di lettura

Ripristina il tuo sito dalla Wayback Machine
Stima gratuita in pochi secondi — paghi solo se confermi. I ripristini falliti vengono rimborsati automaticamente.
Tutti la chiamano macchina del tempo, e il nome resta perché l'esperienza sembra davvero un viaggio nel tempo: digiti un URL, scegli un anno, guardi un sito morto tornare in vita. Ma la metafora si rompe nel momento in cui ti serve qualcosa di specifico. Una vera macchina del tempo ti porterebbe esattamente al secondo che hai chiesto. Questa ti porta dove si trovava il crawler, nel giorno in cui è passato.
Una volta capito come la Wayback Machine del tempo registra davvero il passato, acquisizioni, calendari, timestamp e le lacune tra loro, smetti di tirare a indovinare e inizi a leggerla come uno strumento. Questa guida è il manuale d'uso.
Cosa registra davvero la Wayback Machine del tempo
La Wayback Machine non registra in modo continuo. Effettua acquisizioni discrete: un crawler richiede un URL, memorizza la risposta, HTML, immagini, fogli di stile, script, e la data con l'ora della visita. Per quell'URL, la storia esiste solo in quei momenti. Tutto il resto è inferenza.
La scala è impressionante, centinaia di miliardi di acquisizioni che risalgono al 1996, ma è disomogenea. La homepage di un grande giornale può essere acquisita decine di volte al giorno. Un piccolo sito aziendale riceve forse quattro visite l'anno. Una pagina protetta da login non viene mai acquisita. Tratta ogni URL come una cronologia con una propria densità.
La barra in cima a ogni pagina archiviata è un grafico delle acquisizioni per anno. Le barre alte indicano che il crawler è passato spesso. Anni piatti o assenti significano che non è passato, e i motivi di solito si scoprono una volta che sai dove guardare.
Come leggere la cronologia e la vista calendario
Ripristina il tuo sito dalla Wayback Machine
Stima gratuita in pochi secondi — paghi solo se confermi. I ripristini falliti vengono rimborsati automaticamente.
Apri un URL e hai due strumenti. La barra annuale mostra il numero di acquisizioni per anno. Clicca su un anno e appare un calendario: dodici mesi di giorni, alcuni cerchiati, altri no. I cerchi contengono informazioni che la maggior parte delle persone scorre via.
| Simbolo nel calendario | Cosa significa |
|---|---|
| Cerchio blu | L'acquisizione ha restituito una pagina 2xx normale, il contenuto buono |
| Cerchio verde | L'acquisizione era un reindirizzamento 3xx; il crawler è stato inviato a un altro URL |
| Cerchio arancione | L'acquisizione ha incontrato un errore client 4xx, spesso una pagina eliminata |
| Cerchio rosso | L'acquisizione ha incontrato un errore server 5xx, di solito un sito rotto o morente |
| Cerchio più grande | Più acquisizioni in quel giorno, non solo una |
| Nessun cerchio | Nessuna acquisizione, il crawler non è passato o non è stato autorizzato |
I colori si rivelano subito utili. Un anno di blu seguito da un mese di rosso seguito da verde racconta una storia: il sito si è rotto, poi ha iniziato a reindirizzare, spesso verso una pagina di dominio parcheggiato o un restyling incompiuto. Se stai cercando l'ultima versione sana di un sito, ti serve l'ultimo tratto di blu prima che i colori cambino.
Una volta ho ricostruito la storia di un negozio WooCommerce di un cliente così: blu pieno fino al 2019, qualche rosso a marzo 2020, l'attacco, poi reindirizzamenti verdi verso una pagina di vendita dominio. Il bersaglio del ripristino si è scelto da solo: fine febbraio 2020, l'ultimo mese denso di blu prima che andasse tutto a rotoli.

Come decodificare il timestamp di una snapshot della Wayback Machine del tempo
Ogni URL di acquisizione contiene un timestamp a 14 cifre: /web/20150309142312/https://example.com/. Si legge come anno, mese, giorno, ora, minuto, secondo, in questo caso, le 14:23 del 9 marzo 2015. Puoi modificare quelle cifre a mano, e gli utenti esperti lo fanno in continuazione: cambi la data e l'archivio serve l'acquisizione più vicina al momento richiesto.
- Il timestamp indica l'ora di acquisizione, non l'ora di pubblicazione. Un'acquisizione del 2015 di un articolo scritto nel 2011 riporterà comunque 2015.
- Tutto è in UTC. Un'acquisizione con timestamp 23:58 è avvenuta due minuti prima di mezzanotte GMT, indipendentemente dal tuo fuso orario.
- I file della stessa pagina possono avere timestamp diversi. L'archivio cuce insieme le risorse dalle acquisizioni più vicine, quindi l'HTML e le immagini di una pagina possono essere distanti anche giorni.
- La corrispondenza più vicina funziona nei due sensi. Se chiedi una data senza acquisizioni, ottieni quella più vicina, che potrebbe essere distante mesi su una cronologia rada. Controlla sempre il timestamp effettivo di ciò che è stato caricato.
Perché si verificano le lacune di acquisizione (e cosa ti raccontano)
Le lacune sono la norma, non l'eccezione, e di solito hanno cause identificabili.
- Popolarità. La frequenza di crawling dipende grossomodo da quanto un sito è linkato e visitato. I siti poco conosciuti vengono crawlati di rado.
- Robots.txt. Per anni una regola di disallow ha tenuto fuori il crawler del tutto, e vecchie richieste di esclusione possono ancora nascondere interi domini.
- Downtime. Se il sito era giù quando è passato il crawler, ottieni un cerchio rosso o niente del tutto.
- Rendering JavaScript. Le pagine che costruiscono il contenuto lato client sono spesso state acquisite come gusci vuoti.
- Login e paywall. Tutto ciò che sta dietro un'autenticazione è invisibile al crawler.
- Cambi di proprietà. Un dominio scaduto parcheggiato per un anno genera un calendario pieno di acquisizioni di reindirizzamento ed errori.
Lette in chiave diagnostica, le lacune sono dati. Un buco di due anni in una cronologia altrimenti densa di solito indica un cambio nel robots, un dominio scaduto o un lungo periodo di inattività, tutte informazioni preziose prima di acquistare quel dominio o fidarti di quella storia.
Un flusso di lavoro cronologico per investigare un sito
- Parti dalla fine. Trova le ultime acquisizioni blu sane, poi torna indietro anno per anno finché non trovi il contenuto che cerchi.
- Campiona a intervalli. Su una cronologia densa, controlla prima un'acquisizione per trimestre; passa ai mesi solo dove qualcosa è cambiato.
- Fai attenzione alle discontinuità. Un restyling improvviso, un cambio di struttura degli URL o un'ondata di acquisizioni di reindirizzamento segnano un confine, i contenuti più vecchi potrebbero trovarsi sotto URL diversi.
- Verifica oltre la homepage. Apri cinque o dieci pagine interne chiave nell'epoca scelta. Un'acquisizione della homepage non dimostra nulla sul resto del sito.
- Annota gli URL e i timestamp esatti delle acquisizioni man mano che procedi. "Da qualche parte nel 2012" non è una citazione e non è nemmeno un bersaglio di ripristino.
Un cliente voleva recuperare un forum phpBB del 2009. La cronologia mostrava acquisizioni fitte dal 2010 al 2013, un restyling nel 2014 che aveva stravolto gli URL dei thread, e un dominio parcheggiato dal 2016 in poi. Il punto ideale era il 2012–2013: thread completi, allegati funzionanti, prima dello spam. Due ore di lettura cronologica hanno risparmiato una settimana di ripristino dell'epoca sbagliata.

Quando la Wayback Machine del tempo non basta
Due limiti duri colgono impreparati. Primo, l'archivio mostra le pagine una alla volta, in un browser, non c'è un pulsante per scaricare un intero sito, e ricostruire a mano qualcosa di più grande di una dozzina di pagine è una sofferenza. Secondo, alcune cose non sono mai state acquisite: funzionalità basate su database, funzioni di ricerca, carrelli, tutto ciò che il crawler non poteva vedere.
La soluzione al primo limite è uno strumento di ripristino dedicato. Restorix estrae ogni file archiviato di un sito in un intervallo di date che scegli tu, che è esattamente ciò che ti dice la lettura della cronologia, e lo ricostruisce come sito funzionante. Il preventivo gratuito riporta il numero esatto di file archiviati, la dimensione totale e un prezzo bloccato prima che tu spenda qualsiasi cosa; paghi per file ripristinato, e il primo file è gratis.
Se sei indeciso tra due epoche, richiedi il preventivo gratuito su entrambi gli intervalli di date e confronta il numero di file, un modo economico per capire quale periodo è coperto meglio dall'archivio. Una volta iniziato, la dashboard di ripristino mostra l'avanzamento in tempo reale, file per file.
Ripristina il tuo sito dalla Wayback Machine
Stima gratuita in pochi secondi — paghi solo se confermi. I ripristini falliti vengono rimborsati automaticamente.
FAQ
Cosa significano i cerchi colorati nel calendario della Wayback Machine?
Codificano la risposta del server al momento dell'acquisizione: blu per una pagina 2xx normale, verde per un reindirizzamento 3xx, arancione per un errore client 4xx, rosso per un errore server 5xx. Un cerchio più grande significa più acquisizioni in quel giorno. Lunghe sequenze di blu sono ciò che cerchi quando scegli un bersaglio di ripristino.
Con quale frequenza la Wayback Machine acquisisce un sito?
Non c'è un calendario fisso. La frequenza di crawling dipende grossomodo dalla popolarità del sito e dal suo profilo di link: una grande testata può essere acquisita molte volte al giorno, un piccolo sito aziendale poche volte l'anno. Puoi forzare l'acquisizione di qualsiasi pagina pubblica in qualsiasi momento con lo strumento Save Page Now.
Cosa significa esattamente il timestamp a 14 cifre in un URL di acquisizione?
È l'ora di crawling di quel file in UTC: anno, mese, giorno, ora, minuto, secondo. Registra quando il crawler ha recuperato il file, non quando il contenuto è stato scritto. Se richiedi una data senza acquisizioni, l'archivio serve silenziosamente quella più vicina, quindi controlla sempre il timestamp di ciò che è stato effettivamente caricato.
Perché una vecchia acquisizione appare rotta o senza stile?
L'HTML è stato acquisito ma alcune risorse no, immagini, CSS o script potrebbero essere stati bloccati, persi o acquisiti in una data diversa. Le pagine che renderizzano il contenuto con JavaScript sono spesso state acquisite come gusci vuoti. Un'acquisizione dall'aspetto rotto di solito indica un'acquisizione parziale.
Due acquisizioni dello stesso giorno possono essere diverse?
Sì. Gli URL più popolari possono essere crawlati più volte in un giorno, e ogni acquisizione è un record a sé. Inoltre, ogni file di una pagina ha un proprio timestamp, quindi due viste assemblate da acquisizioni più vicine diverse possono differire in dettagli come le immagini.
Posso scaricare un intero sito da una snapshot della Wayback Machine del tempo?
Non tramite l'interfaccia di archive.org, serve una pagina alla volta. Uno strumento di ripristino come Restorix scarica l'intero sito archiviato in un intervallo di date che scegli tu, mostra prima un preventivo gratuito con il numero esatto di file e il prezzo bloccato, e può ripubblicare il sito sul tuo hosting in un clic.
Guide correlate

wayback machine
Wayback Machine: la guida completa alla storia del web
Il Wayback Machine archivia oltre 900 miliardi di pagine web. Scopri come funzionano le scansioni, le istantanee, il calendario e la sintassi di ricerca, e come ripristinare un sito perso.

website history
Cronologia di un sito web: snapshot, WHOIS, DNS e gli strumenti per ciascuno
La cronologia di un sito può significare snapshot archiviati, record WHOIS, modifiche DNS o vecchie posizioni in SERP. Scopri quale strumento risponde a quale domanda, e come ricostruire un sito perduto.

wayback machine restore
Ripristino da Wayback Machine: 4 insidie e come evitarle
Un ripristino da Wayback Machine può fallire in silenzio: pagine parcheggiate, catene di redirect, immagini mancanti, timestamp incoerenti. Come riconoscere ogni insidia e evitarla.

see history of website
Vedi la cronologia delle modifiche di un sito web: una guida passo passo
Vuoi vedere la cronologia del design e dei contenuti di un sito web? Questa guida spiega l'interfaccia della timeline di Wayback e come scegliere l'unico snapshot che vale davvero la pena ripristinare.
