Recuperación de sitios web antiguos: Cómo recuperar un sitio después de años fuera de línea
Por el equipo editorial de Restorix · 22 de abril de 2026 · 11 min de lectura

Restaura tu sitio web desde la Wayback Machine
Estimación gratuita en segundos — solo pagas al confirmar. Los fallos se reembolsan automáticamente.
Un cliente me llamó la primavera pasada con un problema conocido. Su empresa de jardinería había funcionado durante años con un sitio web creado en 2013: un sitio folleto ordenado, una galería de jardines terminados y un formulario de cotización que le traía la mayor parte del trabajo. El dominio caducó en 2019. La cuenta de hosting se canceló mucho antes. El diseñador se jubiló en Portugal y dejó de responder correos. Me hizo la pregunta que todos hacen en esta situación: ¿es realmente posible recuperar un sitio web antiguo o tengo que empezar desde cero?
La respuesta honesta: probablemente sí, y probablemente más de lo que esperas. Casi todo lo que un sitio web público mostró alguna vez a los visitantes fue copiado en algún lugar: por rastreadores de archivos, por motores de búsqueda, por el script de copia de seguridad de alguien. El trabajo consiste en saber qué sobrevive y dónde, y ser honesto sobre las lagunas. Este es el flujo de trabajo que uso en trabajos como el suyo, y las expectativas que establezco antes de que alguien gaste un solo dólar.
Qué significa realmente recuperar un sitio web antiguo
Recuperar un sitio web antiguo no es un rediseño, ni es 'constrúyeme un sitio nuevo que se parezca al anterior'. Significa encontrar copias existentes del sitio, HTML archivado, imágenes, hojas de estilo, documentos, y volver a ensamblarlas en un sitio web funcional que vuelvas a poseer. Uno que puedas poner en un dominio, editar y del que obtener clientes potenciales. La distinción importa porque cambia el precio en un orden de magnitud: la recuperación reutiliza lo que ya existe, mientras que una reconstrucción paga a alguien para recrearlo a partir de capturas de pantalla y memoria.
Tres tipos de fuentes hacen el trabajo pesado. Los archivos web, sobre todo la Wayback Machine, contienen copias rastreadas de páginas públicas que datan de décadas atrás. Las cachés de los motores de búsqueda solían ser la segunda opción, pero Google retiró su caché en 2024, así que ese pozo está prácticamente seco. Y las copias de seguridad reales, de tu antiguo hosting, de tu antiguo desarrollador o de un disco duro en un cajón, son el único lugar donde sobreviven las piezas internas. Cada fuente te entrega una porción diferente del sitio antiguo.
Dónde residen realmente las copias de tu sitio
Restaura tu sitio web desde la Wayback Machine
Estimación gratuita en segundos — solo pagas al confirmar. Los fallos se reembolsan automáticamente.
Antes de restaurar nada, haz un inventario de las fuentes. Esto es lo que cada una contiene de forma realista para un sitio que ha estado fuera de línea durante años:
| Fuente | Lo que obtienes | Cobertura típica | La pega |
|---|---|---|---|
| Wayback Machine | Páginas HTML, imágenes, CSS, algo de JavaScript | Años de instantáneas, a menudo cientos de URLs | Nada interactivo funcionó nunca allí: formularios, carritos e inicios de sesión son solo visuales |
| archive.today | Instantáneas de páginas individuales | Irregular, pero a menudo conserva páginas que Wayback omitió | Sin rastreo masivo; recuperas una URL a la vez |
| Cachés de motores de búsqueda | La última versión rastreada de una página | Google cerró su caché pública en 2024 | Inútil para un sitio fuera de línea durante años |
| Copias de seguridad del hosting antiguo | Todo, incluida la base de datos | Todo o nada | La mayoría de los hostings eliminan las copias de seguridad a las pocas semanas de la cancelación; pregunta de todos modos |
| Los archivos del desarrollador | Código fuente, quizás un volcado de base de datos | Depende totalmente de su orden | Las agencias cierran; los portátiles se formatean; la gente se jubila en Portugal |
| Tus propias descargas | Lo que hayas guardado por casualidad | Aleatorio | Nadie piensa que lo necesita hasta el día en que lo necesita |
Lee esa tabla y salta a la vista un patrón: la capa de presentación sobrevive, la capa de aplicación no. HTML, CSS e imágenes eran públicos, así que los rastreadores los copiaron. Los scripts PHP, las bases de datos y los paneles de administración estaban detrás del servidor web, donde ningún rastreador podía verlos. Para un sitio folleto o blog, la capa de presentación es casi todo el sitio. Para una tienda o foro, recuperas el catálogo y el contenido, no los pedidos, las cuentas ni los mensajes privados.

Expectativas realistas para la recuperación de un sitio web antiguo
Establezco expectativas con números antes de tocar el sitio de nadie, porque la esperanza no es un plan. Basándome en trabajos de recuperación de los últimos años, esto es lo que parece un buen resultado:
- Páginas estáticas y entradas de blog: 90–100% recuperables si el sitio permitía el rastreo.
- Imágenes: normalmente 70–95%, dependiendo de la profundidad del rastreo del archivo y de si estaban en un dominio CDN separado.
- PDFs y descargas: cara o cruz. Los rastreadores a menudo omitían archivos por encima de un umbral de tamaño.
- Vídeo: asume que se ha perdido a menos que estuviera en YouTube o Vimeo, en cuyo caso nunca se perdió.
- Bases de datos, productos, usuarios, comentarios, pedidos: perdidas a menos que exista una copia de seguridad real. Los archivos solo vieron páginas renderizadas.
- Posiciones en buscadores: parcialmente recuperables. Conserva las URLs originales donde puedas, redirige el resto con 301, y Google vuelve a aprender el sitio más rápido de lo que crees.
Dos trabajos reales. Un foro phpBB de 2009 volvió como unos 400 hilos de HTML estático: cada mensaje legible, cero cuentas de usuario. La tienda WooCommerce de un cliente regresó con su catálogo completo, cada descripción de producto y la mayoría de las fotos, pero sin historial de pedidos ni lista de clientes. Ambos propietarios quedaron contentos, porque ambos conocían la forma del resultado antes de que empezara el trabajo.
Lo que sobrevive y lo que se pierde para siempre
Un inventario rápido evita que la gente pierda un fin de semana buscando cosas que nunca tuvieron copia:
- Suele sobrevivir: páginas HTML públicas y entradas de blog, además de las imágenes a las que hacían referencia esas páginas.
- Suele sobrevivir: hojas de estilo, archivos JavaScript, fuentes, robots.txt, favicon, a veces sitemap.xml.
- Suele sobrevivir: algunos PDFs y descargas más pequeñas, si las páginas rastreadas enlazaban a ellos.
- Perdido sin copia de seguridad: código del lado del servidor: PHP, Python, plugins, la lógica de plantillas del tema.
- Perdido sin copia de seguridad: la base de datos: productos, metadatos de entradas, usuarios, comentarios, pedidos.
- Perdido sin copia de seguridad: cualquier cosa detrás de un inicio de sesión, y cada formulario funcional, caja de búsqueda y carrito: los archivos conservaron su apariencia, no su funcionamiento interno.
- Perdido sin copia de seguridad: cuentas de correo, configuración del servidor, reglas.htaccess.
Dos trampas merecen mención especial. Si el sitio antiguo tenía un robots.txt que bloqueaba a los rastreadores, los archivos pueden contener casi nada: compruébalo antes de planificar nada. Y las instantáneas tomadas después de que el dominio caducara suelen mostrar una página de aparcamiento o un sitio fraudulento. Restaura siempre a partir de una instantánea tomada mientras el sitio estaba realmente activo; la captura más reciente rara vez es la mejor.
Un flujo de trabajo paso a paso para recuperar un sitio web antiguo
- Enumera las URLs. Extrae el inventario de URLs del sitio desde el índice CDX de Wayback Machine o la vista de calendario, y obtén el sitemap.xml de una instantánea sana si existe.
- Elige el año correcto. Revisa el calendario de instantáneas en busca del último período en que las capturas muestren el sitio real, no una página de aparcamiento o un hackeo.
- Rellena los huecos con archive.today. Las páginas que Wayback omitió a veces existen allí: comprueba tus URLs más importantes una por una.
- Restaura los archivos. Para un puñado de páginas, guardarlas manualmente funciona. Para un sitio completo, ejecuta una restauración automatizada: este servicio muestra un presupuesto gratuito con el número exacto de archivos archivados, el tamaño total y un precio cerrado antes de que pagues nada, luego restaura el sitio con los enlaces internos reescritos y las analíticas antiguas eliminadas si lo deseas.
- Limpia la casa. Elimina las etiquetas de anuncios archivadas y los scripts de seguimiento, canonicaliza www o no-www, y convierte los enlaces internos a relativos para que el sitio funcione en cualquier dominio.
- Mapea las URLs. Conserva las rutas originales siempre que sea posible y redirige con 301 todo lo que descartes deliberadamente.
- Despliega y verifica. Rastrea el sitio restaurado, corrige los errores 404 y luego entrega un sitemap nuevo a Search Console.

La limpieza es donde se estancan los trabajos de bricolaje. Copiar y pegar manualmente desde archive.org te deja con enlaces absolutos que apuntan a web.archive.org y un beacon de analíticas de hace una década disparándose en cada página. Las opciones de restauración existen precisamente para esto: eliminar iframes y código publicitario, minificar recursos y hacer que los enlaces sean independientes del dominio son casillas de verificación, no tardes de buscar y reemplazar.
Errores que arruinan la recuperación de un sitio web antiguo
- Restaurar desde la instantánea más reciente en lugar de la más sana. El último año de un sitio moribundo suele ser páginas de aparcamiento y redirecciones de malware.
- Dejar el dominio en espera mientras deliberas. Compra el dominio de vuelta primero: recuperar contenido en una dirección que posee un ocupante es trabajo perdido.
- Mezclar años de instantáneas. La navegación de 2016 enlaza a páginas que tu copia de 2014 no tiene, y cada menú se convierte en una granja de errores 404.
- Olvidar el subdominio CDN. Si las imágenes estaban en cdn.tusitio.com, comprueba ese nombre de host en el archivo por separado: tiene su propio historial de instantáneas.
- Saltarse la cuestión de los derechos. Restaurar tu propio sitio es una práctica habitual; volver a publicar el contenido de otra persona al por mayor es un problema de derechos de autor.
- Reconstruir en una plataforma cerrada antes de exportar. Consigue primero archivos limpios, la exportación estructurada de artículos a XML, CSV o JSON existe por una razón, y luego decide dónde residen.
Costes, plazos y hacerlo uno mismo frente a contratar a alguien
Bricolaje con copiar y pegar: gratis, y adecuado hasta unas veinte páginas. Presupuesta un fin de semana y mucha paciencia. Los scripts gratuitos de descarga de Wayback manejan el volumen pero te dejan con enlaces internos rotos y recursos faltantes: el impuesto de limpieza de nuevo. Las restauraciones de pago cobran por archivo; Restorix cobra por archivo restaurado con una pequeña tarifa plana por restauración, el primer archivo gratis, el precio cerrado en el momento del presupuesto y nada recurrente. Unos cientos de archivos suelen costar decenas de dólares, y los reembolsos automáticos vuelven a tu saldo si una restauración falla.
Los plazos se desglosan igual en cada trabajo: la restauración en sí es la parte rápida, cientos de páginas en bastante menos de una hora, y el trabajo humano posterior es la parte lenta. El sitio de jardinería de mi cliente volvió como 86 páginas y unas 300 imágenes. El presupuesto tardó un minuto. Su fin de semana se fue en conectar un formulario de cotización funcional y volver a fotografiar dos fotos de jardín que nunca le habían gustado de todos modos. El sitio recuperado fue mejor que el original en una semana, que es la parte que nadie espera.
Volver a poner en línea el sitio recuperado
Un sitio folleto recuperado puede vivir felizmente en un hosting estático barato. Si el propietario quiere editar contenido, y al final siempre lo hace, despliega con un CMS adjunto en lugar de añadirlo después. Restorix despliega en un VPS SSH/SFTP, hosting compartido FTP o S3 con un solo clic, y sus despliegues incluyen un CMS de un solo archivo en /webarchive-cms.php con una contraseña de administrador por sitio, para que el propietario edite texto y cambie imágenes sin tocar código. Elijas lo que elijas, termina con lo esencial y aburrido: analíticas nuevas en lugar de la etiqueta de 2013, un sitemap XML, verificación en Search Console y redirecciones 301 para cada URL que decidiste no recuperar.
Restaura tu sitio web desde la Wayback Machine
Estimación gratuita en segundos — solo pagas al confirmar. Los fallos se reembolsan automáticamente.
FAQ
¿Puedo recuperar un sitio web antiguo si el dominio caducó hace años?
Sí. Los archivos indexan copias por URL, no por propiedad del dominio, así que el contenido sigue allí. Pero compra el dominio de vuelta primero si está disponible: recuperar un sitio en una dirección que no posees es trabajo perdido. Si los ocupantes piden un dineral, restaura en un dominio nuevo y planifica el mapa de URLs con redirecciones en mente desde el primer día.
¿Hasta cuándo puede llegar la recuperación de un sitio web antiguo?
El archivo público de Wayback Machine comienza en 1996. En la práctica, los sitios de aproximadamente 2001 en adelante suelen tener una cobertura utilizable; antes de eso se vuelve irregular, con imágenes faltantes y páginas capturadas a medias. Si tu sitio se lanzó en 1998, espera una recuperación parcial y celebra lo que vuelva.
¿Recuperaré mi base de datos?
No desde ningún archivo web: los rastreadores solo vieron HTML renderizado, por lo que los productos, cuentas de usuario, comentarios y pedidos nunca se copiaron. Una base de datos solo sobrevive en una copia de seguridad real. Llama a tu antigua empresa de hosting de todos modos; algunas conservan almacenamiento en frío mucho más tiempo del que admiten sus páginas de ventas, y un ticket de cinco minutos a veces devuelve un volcado completo.
¿Es legal restaurar un sitio desde un archivo?
Restaurar tu propio sitio, o uno del que hayas adquirido los derechos, es algo habitual. El problema surge cuando alguien vuelve a publicar el contenido de un tercero al por mayor: los derechos de autor sobreviven a la muerte de la cuenta de hosting. En caso de duda, recupera la estructura y reescribe el texto con tus propias palabras.
¿Cuánto cuesta la recuperación de un sitio web antiguo?
El bricolaje cuesta un fin de semana. Una restauración automatizada cobra por archivo: unos cientos de archivos suelen costar decenas de dólares, con el número exacto cerrado en el presupuesto gratuito. Un desarrollador que reconstruya desde cero factura miles. Consigue el presupuesto primero para que cada opción sea una cifra real, no una suposición.
Guías relacionadas

restore old website
Restaurar un sitio web antiguo sin revivir sus problemas
Cómo restaurar un sitio web antiguo: manejar PHP, Flash y framesets antiguos, decidir qué conservar o modernizar y extraer archivos de archivos web.

wayback machine restore
Restauración con Wayback Machine: 4 errores y cómo evitarlos
Una restauración con Wayback Machine puede fallar silenciosamente: páginas en parking, cadenas de redirecciones, imágenes faltantes y fechas mezcladas. Cómo detectar cada error y evitarlo.

restore website from wayback machine
Restaurar un sitio web desde Wayback Machine: guía completa
Restaura un sitio web desde Wayback Machine de principio a fin: elige la instantánea correcta, configura las opciones de restauración y despliega un sitio funcional con CMS en menos de una hora.

website history
Historial de un sitio web: capturas, WHOIS, DNS y las herramientas para cada caso
El historial de un sitio web puede referirse a capturas archivadas, registros WHOIS, cambios de DNS o posiciones antiguas. Descubre qué herramienta responde cada pregunta y cómo reconstruir un sitio perdido.
