Archivia su Wayback: come salvare il tuo sito prima che scompaia
A cura di la redazione di Restorix · 17 giugno 2026 · 8 min di lettura

Ripristina il tuo sito dalla Wayback Machine
Stima gratuita in pochi secondi — paghi solo se confermi. I ripristini falliti vengono rimborsati automaticamente.
Di solito la chiamata è più o meno così: l'host ha spento il server, l'agenzia che ha costruito il sito ha chiuso due anni fa, e l'unico backup è un ZIP su un laptop che nessuno riesce a trovare. Ho sentito qualche versione di questa storia più volte di quante possa contare. Quasi tutti quei siti avrebbero potuto essere salvati con abitudini che non costano nulla e richiedono un'ora al mese.
L'approccio di archiviazione su Wayback è semplice: considera Wayback Machine come una seconda linea di difesa che alimenti attivamente, tieni i tuoi veri backup come prima linea e sappi esattamente come ripristinare se entrambi dovessero servire. Ecco la routine, nell'ordine in cui la imposterei.
Cosa salva l'archivio Wayback, e cosa non salverà mai
Il crawler salva ciò che un browser può recuperare senza effettuare il login: pagine HTML, immagini, fogli di stile, script, PDF e altri file pubblici. Per un tipico sito vetrina o blog, è praticamente tutto ciò che conta.
L'elenco di ciò che non salverà mai è più lungo di quanto la gente pensi.
- Tutto ciò che è protetto da login: aree clienti, pannelli di amministrazione, forum riservati ai membri.
- Database e la logica che li interroga. L'archivio memorizza la pagina renderizzata, non le righe che l'hanno prodotta.
- Gestori di moduli, carrelli e flussi di checkout. Potresti ottenere l'HTML del modulo; non recupererai mai i dati inviati.
- Contenuti che appaiono solo dopo l'esecuzione di JavaScript, quando il crawler ha catturato lo scheletro senza eseguirlo.
- Pagine che blocchi. Un disallow in robots.txt dice ai crawler di stare fuori, tutti i crawler, incluso l'archiviatore.
- Media in streaming e download molto grandi, parzialmente o per niente, a seconda di come sono incorporati.
Niente di tutto ciò rende l'archivio inutile. Significa che archivi a occhi aperti: la facciata pubblica del tuo sito è recuperabile, mentre i meccanismi dietro rimangono un problema di backup tuo.
Save Page Now: Archiviazione su richiesta
Ripristina il tuo sito dalla Wayback Machine
Stima gratuita in pochi secondi — paghi solo se confermi. I ripristini falliti vengono rimborsati automaticamente.
Non devi aspettare il crawler. Lo strumento Save Page Now di Internet Archive, all'indirizzo web.archive.org/save, cattura qualsiasi URL pubblico su richiesta, gratuitamente. Incolla un URL, attendi qualche secondo e la cattura finisce nell'archivio pubblico con un timestamp fresco.
Un account gratuito sblocca le parti interessanti: salvare una pagina più le pagine collegate a un livello di profondità, catturare screenshot e tenere un elenco personale dei tuoi salvataggi. C'è un'estensione del browser per salvataggi con un clic e l'API SPN2 per operazioni in blocco, con una chiave API puoi mettere in coda centinaia di URL da uno script o persino da un foglio di calcolo.
- Salva dopo ogni modifica significativa: nuova landing page, nuovi prezzi, nuovi termini, un post importante del blog.
- Salva prima di ogni operazione rischiosa: redesign, migrazioni, aggiornamenti del CMS, cambi di dominio.
- Verifica sempre. Apri la cattura fresca e controlla che immagini e stili siano effettivamente presenti. Un salvataggio che ha catturato una pagina rotta preserva la pagina rotta.
- Salva anche gli URL meno appariscenti: /about, /contact, /terms, le pagine delle categorie chiave. Le homepage vengono comunque crawlate; sono le pagine profonde a scomparire.

Archiviazione amichevole per Wayback: rendi il tuo sito facile da catturare
La maggior parte dei siti è accidentalmente ostile all'archiviazione. Qualche piccola modifica economica cambia le cose.
- Non bloccare i crawler di archivio in robots.txt e non disallow le tue cartelle di asset (/wp-content/uploads, /static, /assets). Immagini e CSS bloccati sono il motivo per cui le vecchie catture appaiono spoglie.
- Esegui il rendering lato server dei tuoi contenuti importanti. Se il tuo testo esiste solo dopo l'esecuzione di JavaScript, molti crawler salveranno uno scheletro vuoto.
- Mantieni una sitemap.xml pulita. I crawler la usano per trovare pagine profonde che non raggiungerebbero mai seguendo solo i link.
- Mantieni gli URL stabili. Ogni modifica non necessaria di URL orfana la cronologia di archivio collegata al vecchio indirizzo.
- Evita le trappole per crawler: calendari infiniti, ricerca con facet che genera milioni di URL. I crawler consumano il loro budget su robaccia e perdono le tue pagine reali.
Se utilizzi Cloudflare o un altro filtro per bot, verifica che i crawler di archivio non vengano bloccati. Una regola che blocca tutti i bot blocca anche la conservazione della tua cronologia.
Una routine di archiviazione proattiva per il tuo sito
Una volta al mese, quindici minuti:
- Copia i tuoi primi 20-30 URL, dalla sitemap o dalle analisi, e passali attraverso Save Page Now. Con l'API, è un lavoro da un solo comando.
- Salva qualsiasi pagina cambiata dall'ultimo mese.
- Controlla a campione i salvataggi del mese scorso: apri due o tre catture e conferma che effettivamente vengano renderizzate.
Trimestralmente, aggiungi due passaggi: verifica che il tuo robots.txt permetta ancora l'archiviazione e conferma che i tuoi backup reali si ripristinino effettivamente, un backup mai testato è una voce. Prima di qualsiasi redesign o migrazione di piattaforma, esegui il salvataggio completo sull'intera sitemap, non solo sulle pagine principali. Le migrazioni sono dove la cronologia del sito va a morire.
Un'altra abitudine economica: tieni una mappa degli URL in testo semplice del tuo sito da qualche parte fuori dal server, la sitemap stessa va bene. Se mai avessi bisogno di un ripristino in blocco, quell'elenco è oro, perché gli strumenti di ripristino possono lavorare direttamente da esso.

Perché l'archivio non è un backup
Diciamolo chiaramente: Wayback Machine è un museo, non una cassetta di sicurezza. Non puoi premere un pulsante e riavere il tuo sito. Puoi navigare le tue pagine una alla volta, ma non c'è un esportazione dell'intero sito, nessuna garanzia che ogni pagina o immagine sia stata catturata e nessuna promessa di servizio. I proprietari possono anche richiedere la rimozione.
Quindi tieni dei backup veri: snapshot dell'hosting, un repository git per il codice, dump periodici del database e copie conservate fuori dal server, la vecchia regola è che il tuo backup non esiste finché non vive in due posti, uno dei quali fuori sede. Il ruolo dell'archivio è diverso: è il registro pubblico indipendente e timestampato di ciò che il tuo sito diceva e mostrava. Questo ha un valore reale, per controversie, per responsabilità, per provare che una pagina esisteva, ma completa i backup. Non li sostituisce mai.
Checklist di archiviazione su Wayback prima di un redesign o migrazione
- Esegui Save Page Now sull'intera sitemap, inclusi i link esterni per le pagine chiave.
- Fai un backup completo fresco, file più database, e conservalo fuori dal server.
- Esporta un elenco di URL del sito attuale per costruire la mappa dei redirect.
- Pianifica redirect 301 da ogni vecchio URL al suo equivalente nuovo prima di attivare il cambiamento.
- Dopo il lancio, salva le nuove pagine chiave in modo che la cronologia dell'archivio continui senza buchi.
Se stai cambiando dominio, tieni vivo il vecchio, anche un anno di redirect preserva sia l'autorità di ricerca che la continuità dell'archivio. Lasciarlo scadere consegna la tua storia a un parcheggiatore di domini, e i domini parcheggiati sono dove i buoni URL vanno a farsi dimenticare.
Se la prevenzione fallisce: ripristino dall'archivio
A volte ti ritrovi il caos: un sito morto, nessun backup e l'archivio come unica fonte rimasta. È recuperabile più spesso di quanto si pensi. Restorix scarica ogni file archiviato di un sito, pagine, immagini, stili, documenti, e lo ricostruisce come sito funzionante, con un'opzione di intervallo di date per puntare all'era prima che le cose andassero male.
Le condizioni economiche sono amichevoli per i disperati: il preventivo è gratuito e mostra il numero esatto di file, la dimensione totale e un prezzo bloccato prima di pagare; paghi per file ripristinato con il primo file gratuito; e se un ripristino o un deploy fallisce, il rimborso sul tuo saldo è automatico, nessun ticket di supporto. Il deploy è un clic verso SSH/SFTP, FTP o S3, e ogni deploy include un piccolo CMS a file singolo, così il sito recuperato è modificabile anziché una statua congelata.
Provaci una volta su un sito piccolo, il tutorial richiede forse dieci minuti, e saprai esattamente cosa fare il giorno in cui qualcuno farà quella telefonata.
Ripristina il tuo sito dalla Wayback Machine
Stima gratuita in pochi secondi — paghi solo se confermi. I ripristini falliti vengono rimborsati automaticamente.
FAQ
Save Page Now è gratuito?
Sì. Salvare pagine non costa nulla e un account gratuito di Internet Archive aggiunge utili extra: salvare i link esterni a un livello di profondità, screenshot, un elenco personale di salvataggi e chiavi API per il salvataggio in blocco. L'uso automatico intenso incontra limiti di frequenza, ma l'archiviazione di routine del tuo sito rimane ben al di sotto di essi.
Quanto tempo ci vuole prima che una pagina salvata appaia nell'archivio?
Di solito secondi o un paio di minuti. Durante i periodi di maggiore attività, un salvataggio può rimanere in coda più a lungo. Apri sempre la cattura fresca e conferma che sia stata renderizzata correttamente, un salvataggio veloce di una pagina rotta preserva semplicemente il danno.
Posso archiviare il sito di qualcun altro con Save Page Now?
Sì, per le pagine pubbliche, e la gente lo fa costantemente per citazioni e responsabilità. Lo strumento non bypassa login o paywall, poiché il crawler vede solo ciò che vede un visitatore anonimo. Tieni presente che i proprietari del sito possono successivamente richiedere la rimozione.
Salvare le pagine garantisce che l'intero sito venga archiviato?
No. Save Page Now cattura gli URL che invii, più i loro link esterni a un livello di profondità se lo abiliti. Le visite del crawler dell'archivio sono un processo separato che non controlli. Per una copertura completa, invia gli URL della tua sitemap in blocco, e tieni comunque i tuoi backup.
Come posso rimuovere il mio sito dall'archivio?
Contatti Internet Archive e dimostri il controllo del dominio. Le richieste di esclusione di solito fermano la scansione futura e possono anche rendere indisponibili le catture storiche. Pensa attentamente prima di chiedere: l'esclusione cancella il registro pubblico indipendente del tuo sito, che è lo stesso registro di cui potresti aver bisogno un giorno.
Cosa succede se ho bisogno dell'intero sito, non solo di singole pagine?
Navigare le catture una alla volta non ricostruirà un sito. Uno strumento di ripristino come Restorix scarica ogni file archiviato in un intervallo di date, mostra un preventivo gratuito con il numero esatto di file e un prezzo bloccato prima, e può ridistribuire il sito sul tuo hosting con un CMS incluso.
Guide correlate

wayback machine
Wayback Machine: la guida completa alla storia del web
Il Wayback Machine archivia oltre 900 miliardi di pagine web. Scopri come funzionano le scansioni, le istantanee, il calendario e la sintassi di ricerca, e come ripristinare un sito perso.

archiveorg
Archiveorg: dentro la più grande libreria gratuita di Internet
Archiveorg è molto più del Wayback Machine: libri gratuiti, musica dal vivo, notizie TV, software giocabili e oltre 900 miliardi di pagine web. Tour completo, più recupero file.

restore website from wayback machine
Ripristinare un sito web dalla Wayback Machine: guida completa
Ripristina un sito web dalla Wayback Machine dall'inizio alla fine: scegli lo snapshot giusto, imposta le opzioni di ripristino e distribuisci un sito funzionante con un CMS in meno di un'ora.

wayback restore
Wayback Restore: recupera il tuo sito perduto in 5 passi
Wayback restore in cinque semplici passi: trova lo snapshot giusto, ottieni un prezzo esatto prima di pagare, scarica i file ricostruiti e caricali sul tuo hosting.
