Recuperación de páginas web antiguas: las formas más rápidas de encontrar una página perdida
Por el equipo editorial de Restorix · 21 de mayo de 2026 · 8 min de lectura

Restaura tu sitio web desde la Wayback Machine
Estimación gratuita en segundos — solo pagas al confirmar. Los fallos se reembolsan automáticamente.
Alguien te envía un enlace. Haces clic y, en lugar de la página, aparece un 404, o peor, un dominio aparcado lleno de anuncios de pastillas y criptomonedas. La página existía el año pasado. Lo sabes. Puede que la hayas citado. La recuperación de páginas web antiguas es el arte de recuperar esa única página y, a diferencia de restaurar un sitio completo, suele ser un trabajo de diez minutos si llamas a las puertas correctas en el orden adecuado.
Este es el orden que utilizo, del más rápido al más lento, con las tasas de éxito que realmente observo. La buena noticia: para una página pública que existió durante más de unos meses, las probabilidades están claramente a tu favor.
Recuperación de páginas web antiguas: prueba primero la fuente más rápida
El movimiento más rápido en la recuperación de páginas web antiguas no cuesta nada y toma cinco segundos. Pega la URL inactiva en la barra de direcciones de Wayback Machine, o usa el atajo web.archive.org/web/ seguido de la URL, y obtendrás un calendario con cada captura realizada. Elige una fecha y recupera la página. Para páginas que fueron públicas durante un año o más, esto funciona unas ocho de cada diez veces según mi experiencia.
Si sabes aproximadamente cuándo estaba activa la página, añade un año al atajo: web.archive.org/web/2019/ seguido de la URL salta directamente a la captura más cercana de 2019 en lugar de hacerte desplazarte por el calendario. Un pequeño truco, pero que ahorra mucho tiempo cuando estás comprobando una docena de URLs seguidas.
Wayback Machine: la columna vertebral de la recuperación de páginas web antiguas
Restaura tu sitio web desde la Wayback Machine
Estimación gratuita en segundos — solo pagas al confirmar. Los fallos se reembolsan automáticamente.
La Wayback Machine es donde comienzan y terminan la mayoría de las recuperaciones de una sola página, así que aprende sus dos peculiaridades. Primero, el calendario marca las fechas de captura con círculos, círculos más grandes significan más capturas ese día, y los años prósperos son los que hay que explotar, no el año en que murió el dominio. Las últimas capturas de un sitio moribundo suelen ser páginas de aparcamiento. Segundo, lo que recuperas es una instantánea: las imágenes se cargan desde copias archivadas, los enlaces apuntan a otras páginas archivadas y el formulario de contacto ahora no funciona en absoluto.
Otros dos movimientos útiles. La vista Changes resalta lo que difería entre capturas, útil cuando necesitas la versión anterior a que alguien editara la parte que buscabas. Y si Wayback no tiene nada, no te detengas ahí. Es el archivo más grande, pero no el único.
archive.today: el plan de respaldo que a menudo gana
archive.today, también accesible como archive.ph, archive.li y un puñado de otros espejos, es una bestia completamente distinta. Guarda páginas a pedido en lugar de rastrearlas según un horario, no respeta las mismas solicitudes de exclusión y suele albergar páginas que Wayback pasó por alto por completo. Busca la URL en su página principal: si alguien, en algún lugar, pegó ese enlace en su caja de guardado, la instantánea está ahí.
Sus capturas también manejan mejor las páginas modernas. Renderiza JavaScript antes de guardar, por lo que las páginas que aparecen como caparazones vacíos en Wayback a veces regresan completas. La contrapartida es que todo es manual, una página a la vez, está bien para una sola página, pero un dolor para cincuenta.
Qué pasó con la caché de Google y la de Bing
Durante veinte años, la respuesta más rápida a 'la página ya no existe' era la copia en caché de Google. Eso terminó en febrero de 2024, cuando Google retiró el operador de búsqueda cache: y eliminó los enlaces Cached de los resultados. La justificación oficial fue que las páginas ahora cargan de manera suficientemente fiable como para que nadie lo necesite, un pequeño consuelo mientras miras un 404.
Bing mantuvo un enlace de página en caché por más tiempo, escondido en el menú junto a cada resultado, pero también lo ha ido eliminando. Si todavía ves uno, úsalo mientras dure. Las cachés de los motores de búsqueda solo conservaban el rastreo más reciente, lo que las hace inútiles para una página que desapareció hace años, pero para una página eliminada el martes pasado, pueden ser la única copia que existió.
Lugares que la gente olvida comprobar
- Citas de Wikipedia. Si la página fue citada alguna vez en Wikipedia, la cita suele incluir un enlace 'archivado desde el original' a una instantánea. Revisa también el historial de ediciones del artículo.
- Common Crawl. Un conjunto de datos de rastreo público y gratuito en index.commoncrawl.org. HTML en bruto, sin interfaz bonita, difícil de consultar, y páginas que nadie más conservó.
- Lectores de RSS. Feedly, Inoreader y similares almacenan el texto de los artículos obtenidos. Si la página era una entrada de blog con feed, su texto completo puede estar ahora mismo en los lectores de desconocidos.
- Tu propio navegador. Si visitaste la página recientemente, tu historial confirma la URL exacta, y a veces una recarga recupera la página de la caché del disco antes de que llegue el 404. Bajas probabilidades, coste cero.
- Aplicaciones de 'leer más tarde'. Guardados en Pocket e Instapaper, tuyos o del autor.
- El autor. Un breve correo electrónico, 'Cité tu artículo, ¿aún tienes una copia?', funciona con más frecuencia de lo que la gente cree.

Recuperación de páginas web antiguas cuando no se archivó nada
A veces la respuesta honesta es que no existe ninguna instantánea: la página era demasiado nueva, el sitio bloqueó los rastreadores o vivía detrás de un inicio de sesión. La recuperación de páginas web antiguas no termina en ese punto, pero las herramientas pasan de archivos a forense digital.
Busca frases distintivas de la página entre comillas, los sitios que sindicaron, citaron o simplemente copiaron el contenido aparecerán, y puedes reconstruir la sustancia a partir de los suyos. Busca solo el título de la página: los rediseños mueven el contenido a nuevas URLs todo el tiempo sin avisar a nadie, y la página 'eliminada' a menudo vive en una nueva dirección en el mismo sitio. Busca versiones PDF o para imprimir; la documentación y el contenido académico suelen tener una. Y comprueba quién enlazaba a ella, un bloguero que haya resumido la página en detalle ya ha hecho la mitad de tu reconstrucción.
Recuperación de páginas web antiguas: qué fuente probar primero
| Tu situación | Prueba primero | Después | Dato útil |
|---|---|---|---|
| Página pública, en línea durante un año o más | Wayback Machine | archive.today | La tasa de éxito más alta de cualquier ruta |
| Página eliminada en las últimas semanas | Enlace en caché de Bing | Common Crawl | Los archivos pueden no haberla rastreado aún |
| El sitio bloqueó rastreadores o el archivado | archive.today | Búsqueda de frases entre comillas | Diferentes servicios aplican diferentes exclusiones |
| Solo necesitas un dato o cita | Búsqueda de frases entre comillas | Citas de Wikipedia | Los fragmentos a menudo responden la pregunta directamente |
| Visitaste la página tú mismo recientemente | Historial y caché del navegador | RSS o aplicaciones de 'leer más tarde' | Confirma la URL exacta antes que nada |
Una página es un trabajo de diez minutos con esta tabla. Veinte páginas del mismo sitio ya no es recuperación de páginas web antiguas, es una restauración de sitio. Cuando llegues a ese punto, deja de obtener URLs una por una y restaura en masa: la plataforma de restauración ofrece una estimación gratuita con el recuento exacto de archivos archivados antes de que gastes nada, lo que también te dice si vale la pena restaurar el sitio. Si todo el sitio ha desaparecido, consulta recuperación de sitios web antiguos para la versión completa de esta guía.
Guarda la página correctamente esta vez
Sea lo sea que recuperes, asume que puede desaparecer de nuevo, los archivos tienen vacíos, las reglas de exclusión cambian, los servicios van y vienen. Guarda la página de tres formas, ahora mismo. Envía la URL activa a Save Page Now de Wayback Machine para que exista una instantánea fresca en tu horario. Envíala a archive.today como segunda copia independiente. Y guarda una copia local que ningún servicio controle: una impresión a PDF, o un guardado de HTML en un solo archivo desde tu navegador. Tres copias en tres sistemas suena paranoico hasta el día en que suena obvio.
Si la página recuperada es tuya y va a volver a estar en línea, la misma lógica se aplica a mayor escala: restaura el sitio correctamente, mantén los archivos editables y no vuelvas a depender de la memoria de un rastreador para tu propio contenido. El tutorial de Restorix recorre una restauración completa si quieres ver el proceso antes de comprometerte.

Restaura tu sitio web desde la Wayback Machine
Estimación gratuita en segundos — solo pagas al confirmar. Los fallos se reembolsan automáticamente.
FAQ
¿Aún existe la caché de Google?
No. Google retiró su función de páginas en caché en febrero de 2024, tanto el operador de búsqueda cache: como los enlaces Cached en los resultados han desaparecido. Bing todavía muestra un enlace de página en caché en algunos resultados a través del menú junto a cada listado, pero también se está eliminando progresivamente. Para cualquier cosa anterior a unas semanas, ve directamente a Wayback Machine.
¿Puedo recuperar una página web antigua que nunca se archivó en ningún lugar?
A veces, parcialmente. Las búsquedas de frases entre comillas encuentran copias sindicadas y citas, las citas de Wikipedia a menudo enlazan a instantáneas que pasaste por alto, y el autor puede tener el original. Normalmente reconstruirás la sustancia en lugar de la página exacta, y algunas páginas simplemente han desaparecido.
¿Cómo puedo ver una página tal como lucía en una fecha específica?
Usa el calendario de Wayback Machine: pega la URL, haz clic en un año y luego en una fecha resaltada. El atajo web.archive.org/web/2019/ seguido de la URL salta a la captura más cercana a esa fecha. Las capturas conservan el HTML y las imágenes de ese día, enlaces incluidos.
¿Por qué Wayback dice que una página fue bloqueada o excluida?
Normalmente por robots.txt, el sitio bloqueó los rastreadores en algún momento y el archivo respetó eso. Prueba archive.today en su lugar, ya que aplica reglas diferentes, o Common Crawl para el HTML en bruto.
¿Es legal la recuperación de páginas web antiguas?
Ver y guardar copias archivadas para referencia, citación o investigación es una práctica normal. Republicar la página recuperada de otra persona como tu propio contenido es donde el copyright muerde. Recupera para referenciar y atribuir, o recupera tus propias páginas directamente.
Guías relacionadas

web cache
Caché web explicado: cómo funcionan las cachés y cómo usar una
Qué es una caché web, cómo funcionan las cachés del navegador, CDN, motores de búsqueda y archivos, y cómo usar una caché web para ver una página que ha desaparecido.

wayback machine
Wayback Machine: La guía completa para navegar por el historial web
Wayback Machine archiva más de 900 mil millones de páginas web. Aprende cómo funcionan los rastreos, las capturas, el calendario y la sintaxis de búsqueda, y cómo restaurar un sitio perdido.

restore deleted site
Restaurar un sitio eliminado: qué hacer en las primeras 48 horas
¿Tu hosting eliminó tu sitio? Sigue este plan de triaje de 48 horas y luego restaura el sitio eliminado desde los archivos web paso a paso.

old website recovery
Recuperación de sitios web antiguos: Cómo recuperar un sitio después de años fuera de línea
Recuperación de sitios web antiguos explicada: qué sobrevive en archivos y copias de seguridad tras años fuera de línea, qué se pierde para siempre y cómo reconstruir paso a paso.
