Archivo Wayback: Cómo guardar tu sitio antes de que desaparezca
Por el equipo editorial de Restorix · 17 de junio de 2026 · 8 min de lectura

Restaura tu sitio web desde la Wayback Machine
Estimación gratuita en segundos — solo pagas al confirmar. Los fallos se reembolsan automáticamente.
La llamada suele ser así: el hosting apagó el servidor, la agencia que construyó el sitio cerró hace dos años y la única copia de seguridad es un ZIP en un portátil que nadie encuentra. He escuchado alguna versión de esa historia más veces de las que puedo contar. Casi todos esos sitios se habrían podido salvar con hábitos que no cuestan nada y llevan una hora al mes.
El enfoque de archivo wayback es sencillo: trata la Wayback Machine como una segunda línea de defensa que alimentas activamente, mantén tus propias copias de seguridad reales como primera línea y sabe exactamente cómo restaurarías si ambas llegaran a importar. Aquí está la rutina, en el orden en que la configuraría.
Lo que el archivo Wayback guarda, y lo que nunca guardará
El crawler guarda lo que un navegador puede obtener sin iniciar sesión: páginas HTML, imágenes, hojas de estilo, scripts, PDFs y otros archivos públicos. Para un sitio corporativo típico o un blog, eso es prácticamente todo lo que importa.
La lista de lo que nunca guardará es más larga de lo que la gente espera.
- Cualquier cosa detrás de un inicio de sesión: áreas de clientes, paneles de administración, foros solo para miembros.
- Bases de datos y la lógica que se comunica con ellas. El archivo almacena la página renderizada, no las filas que la generaron.
- Gestores de formularios, carritos y flujos de pago. Puedes obtener el HTML del formulario; nunca recuperarás los envíos.
- Contenido que solo aparece después de que se ejecute JavaScript, cuando el crawler capturó la estructura sin ejecutarlo.
- Páginas que bloqueas. Un disallow en robots.txt indica a los crawlers que se mantengan fuera, a todos los crawlers, incluido el archivador.
- Medios de streaming y descargas muy grandes, de forma parcial o nada, dependiendo de cómo estén incrustados.
Nada de esto hace que el archivo sea inútil. Significa que archivas con los ojos abiertos: la cara pública de tu sitio es recuperable, mientras que la maquinaria que hay detrás sigue siendo tu propio problema de copia de seguridad.
Save Page Now: Archivar bajo demanda
Restaura tu sitio web desde la Wayback Machine
Estimación gratuita en segundos — solo pagas al confirmar. Los fallos se reembolsan automáticamente.
No tienes que esperar al crawler. La herramienta Save Page Now de Internet Archive, en web.archive.org/save, captura cualquier URL pública bajo petición, gratis. Pega una URL, espera unos segundos y la captura llega al archivo público con una marca de tiempo nueva.
Una cuenta gratuita abre las partes que merecen la pena: guardar una página junto con sus enlaces salientes un nivel de profundidad, capturar pantallazos y mantener una lista personal de tus guardados. Hay una extensión de navegador para guardados con un clic, y la SPN2 API para trabajo masivo, con una API key, puedes poner en cola cientos de URLs desde un script o incluso una hoja de cálculo.
- Guarda después de cada cambio importante: nueva landing page, nuevos precios, nuevos términos, un post destacado del blog.
- Guarda antes de cada operación arriesgada: rediseños, migraciones, actualizaciones del CMS, cambios de dominio.
- Verifica siempre. Abre la captura nueva y comprueba que las imágenes y los estilos realmente se guardaron. Un guardado que capturó una página rota conserva la página rota.
- Guarda también las URLs menos llamativas: /about, /contact, /terms, páginas clave de categorías. Las homepages se rastrean de todos modos; las páginas profundas son las que desaparecen.

Archivo Wayback-friendly: Haz que tu sitio sea fácil de capturar
La mayoría de los sitios son accidentalmente hostiles al archivado. Unas pocas soluciones baratas lo cambian.
- No bloquees los crawlers de archivo en robots.txt y no prohíbas tus carpetas de recursos (/wp-content/uploads, /static, /assets). Las imágenes y el CSS bloqueados son la razón por la que las capturas antiguas se ven desnudas.
- Renderiza en el servidor tu contenido importante. Si tu texto solo existe después de que se ejecute JavaScript, muchos crawlers guardarán una estructura vacía.
- Mantén un sitemap.xml limpio. Los crawlers lo usan para encontrar páginas profundas que nunca alcanzarían siguiendo enlaces por sí solos.
- Mantén las URLs estables. Cada cambio innecesario de URL deja huérfano el historial de archivo asociado a la dirección anterior.
- Evita las trampas de rastreo: calendarios infinitos, búsquedas con facetas que generan millones de URLs. Los crawlers gastan su presupuesto en basura y se pierden tus páginas reales.
Si usas Cloudflare u otro filtro de bots, comprueba que los crawlers de archivo no estén siendo bloqueados. Una regla que bloquea todos los bots también bloquea la preservación de tu propio historial.
Una rutina de archivado proactivo para tu propio sitio
Una vez al mes, quince minutos:
- Copia tus 20–30 URLs principales, desde tu sitemap o tu analítica, y pásalas por Save Page Now. Con la API, es un trabajo de un solo comando.
- Guarda cualquier página que haya cambiado desde el mes pasado.
- Revisa al azar los guardados del mes pasado: abre dos o tres capturas y confirma que realmente se renderizan.
Trimestralmente, añade dos pasos: verifica que tu robots.txt siga permitiendo el archivado y confirma que tus copias de seguridad reales realmente se restauran, una copia de seguridad que nunca has probado es un rumor. Antes de cualquier rediseño o migración de plataforma, ejecuta el guardado completo sobre todo tu sitemap, no solo las páginas principales. Las migraciones son donde el historial del sitio va a morir.
Un hábito más barato: guarda un mapa de URLs en texto plano de tu sitio en algún lugar fuera del servidor, el propio sitemap sirve. Si alguna vez necesitas una restauración masiva, esa lista es oro, porque las herramientas de restauración pueden trabajar directamente desde ella.

Por qué el archivo no es una copia de seguridad
Dígalo claramente: la Wayback Machine es un museo, no una caja fuerte. No puedes pulsar un botón y recuperar tu sitio de ella. Puedes navegar tus páginas una a una, pero no hay exportación de todo tu sitio, ninguna garantía de que cada página o imagen haya sido capturada y ninguna promesa de nivel de servicio. Los propietarios también pueden solicitar eliminaciones.
Así que mantén copias de seguridad reales: snapshots del hosting, un repositorio git para el código, volcados periódicos de la base de datos y copias almacenadas fuera del servidor, la regla de siempre es que tu copia de seguridad no existe hasta que vive en dos lugares, uno de ellos fuera del sitio. El papel del archivo es distinto: es el registro independiente, con marca de tiempo y público de lo que tu sitio dijo y mostró. Eso tiene valor real, para disputas, para rendición de cuentas, para demostrar que una página existió, pero complementa a las copias de seguridad. Nunca las sustituye.
Checklist de archivo Wayback antes de un rediseño o migración
- Ejecuta Save Page Now sobre todo tu sitemap, incluyendo enlaces salientes para las páginas clave.
- Haz una copia de seguridad completa nueva, archivos más base de datos, y guárdala fuera del servidor.
- Exporta una lista de URLs del sitio actual para construir tu mapa de redirecciones.
- Planifica redirecciones 301 de cada URL antigua a su equivalente nueva antes de hacer el cambio.
- Después del lanzamiento, guarda las nuevas páginas clave para que la línea de tiempo del archivo continúe sin un hueco.
Si estás cambiando de dominio, mantén el antiguo activo, incluso un año de redirecciones preserva tanto el valor de búsqueda como la continuidad del archivo. Dejar que caduque entrega tu historial a un parking de dominios, y los dominios aparcados son donde las buenas URLs van a ser olvidadas.
Si la prevención falla: Restaurar desde el archivo
A veces heredas el desastre: un sitio muerto, sin copias de seguridad y el archivo como única fuente restante. Es recuperable más a menudo de lo que la gente cree. Restorix descarga cada archivo archivado de un sitio, páginas, imágenes, estilos, documentos, y lo reconstruye como un sitio web funcional, con una opción de rango de fechas para que puedas apuntar a la era anterior a que las cosas fueran mal.
La economía es amable con los desesperados: la estimación es gratuita y muestra el recuento exacto de archivos, el tamaño total y un precio fijado antes de pagar; pagas por archivo restaurado con el primer archivo gratis; y si una restauración o un despliegue falla, el reembolso a tu saldo es automático, sin ticket de soporte. El despliegue es un clic a SSH/SFTP, FTP o S3, y cada despliegue incluye un pequeño CMS de un solo archivo, de modo que el sitio rescatado es editable en lugar de una estatua congelada.
Hazlo una vez en un sitio pequeño, el tutorial lleva unos diez minutos, y sabrás exactamente qué hacer el día que alguien haga esa llamada.
Restaura tu sitio web desde la Wayback Machine
Estimación gratuita en segundos — solo pagas al confirmar. Los fallos se reembolsan automáticamente.
FAQ
¿Save Page Now es gratis?
Sí. Guardar páginas no cuesta nada, y una cuenta gratuita de Internet Archive añade extras útiles: guardar enlaces salientes un nivel de profundidad, capturas de pantalla, una lista personal de guardados y API keys para guardado masivo. El uso automatizado intensivo choca con límites de frecuencia, pero el archivado rutinario de tu propio sitio se mantiene muy por debajo de ellos.
¿Cuánto tarda una página guardada en aparecer en el archivo?
Normalmente de segundos a un par de minutos. En periodos de mucha actividad, un guardado puede permanecer en cola más tiempo. Abre siempre la captura nueva y confirma que se renderizó correctamente, un guardado rápido de una página rota solo conserva el fallo.
¿Puedo archivar el sitio de otra persona con Save Page Now?
Sí, para páginas públicas, y la gente lo hace constantemente para citas y rendición de cuentas. La herramienta no elude inicios de sesión ni muros de pago, ya que el crawler solo ve lo que un visitante anónimo ve. Ten en cuenta que los propietarios del sitio pueden solicitar eliminaciones posteriormente.
¿Guardar páginas garantiza que todo mi sitio se archive?
No. Save Page Now captura las URLs que envías, más sus enlaces salientes un nivel de profundidad si lo activas. Las visitas del propio crawler del archivo son un proceso aparte que no controlas. Para una cobertura completa, envía las URLs de tu sitemap de forma masiva, y mantén tus propias copias de seguridad de todos modos.
¿Cómo elimino mi propio sitio del archivo?
Contactas con Internet Archive y demuestras el control del dominio. Las solicitudes de exclusión normalmente detienen el rastreo futuro y también pueden hacer que las capturas históricas dejen de estar disponibles. Piénsalo bien antes de pedirlo: la exclusión borra el registro público independiente de tu sitio, que es el mismo registro que podrías necesitar algún día.
¿Qué pasa si necesito recuperar todo el sitio, no solo páginas sueltas?
Navegar las capturas una a una no reconstruirá un sitio. Una herramienta de restauración como Restorix descarga cada archivo archivado en un rango de fechas, muestra una estimación gratuita con el recuento exacto de archivos y un precio fijado primero, y puede redesplegar el sitio en tu hosting con un CMS incluido.
Guías relacionadas

wayback machine
Wayback Machine: La guía completa para navegar por el historial web
Wayback Machine archiva más de 900 mil millones de páginas web. Aprende cómo funcionan los rastreos, las capturas, el calendario y la sintaxis de búsqueda, y cómo restaurar un sitio perdido.

archiveorg
Archiveorg: Dentro de la biblioteca gratuita más grande de Internet
Archiveorg es mucho más que la Wayback Machine: libros gratis, música en vivo, noticieros de TV, software jugable y más de 900 mil millones de páginas web. Recorrido completo, además de recuperación de archivos.

restore website from wayback machine
Restaurar un sitio web desde Wayback Machine: guía completa
Restaura un sitio web desde Wayback Machine de principio a fin: elige la instantánea correcta, configura las opciones de restauración y despliega un sitio funcional con CMS en menos de una hora.

wayback restore
Restauración Wayback: Recupera tu sitio perdido en 5 pasos
Restauración Wayback en cinco pasos sencillos: encuentra la instantánea correcta, obtén un precio exacto antes de pagar, descarga los archivos reconstruidos y súbelos a tu hosting.
