Wayback Machine vs Google: Encuentra páginas perdidas tras la caché
Por el equipo editorial de Restorix · 11 de mayo de 2026 · 8 min de lectura

Restaura tu sitio web desde la Wayback Machine
Estimación gratuita en segundos — solo pagas al confirmar. Los fallos se reembolsan automáticamente.
Durante veinte años, la forma más rápida de ver una página que acababa de caer era el enlace Caché de Google. En febrero de 2024 Google lo eliminó, y en septiembre el operador de búsqueda cache: dejó de funcionar también. Ese mismo año, Google hizo algo inesperado: empezó a enlazar al Wayback Machine del Internet Archive desde su panel Acerca de este resultado. El mensaje fue claro: Google es un índice en vivo, no un archivo, y dejó de fingir lo contrario.
Pero las dos herramientas siguen funcionando mejor juntas. Así es como las combino cuando una página o un sitio entero ha desaparecido, incluidos los trucos de operadores que sobrevivieron a la purga.
Wayback Machine vs Google: dos tipos diferentes de memoria
Google mantiene un índice de la web en vivo. Recrawlea constantemente, reescribe los rankings cada hora, y su único propósito es responder con lo que es cierto ahora mismo. Cuando una página cambia, la versión anterior se descarta en el siguiente rastreo. Cuando la página desaparece, el listado permanece brevemente y luego se cae.
El Wayback Machine hace lo contrario. Es una biblioteca de capturas append-only que se extiende hasta 1996, más de 900 mil millones de páginas. No le importa qué es relevante esta semana; le importa lo que la página decía el 12 de marzo de 2014, y te mostrará esa versión exacta, con todo y diseño.
Así que las herramientas responden preguntas diferentes. Google: ¿qué hay en esta página ahora? Wayback: ¿qué decía esta página antes? La confusión entre ambas es la razón por la que tanta gente cree que la web tiene una memoria que no tiene.
Qué pasó con la caché de Google
Restaura tu sitio web desde la Wayback Machine
Estimación gratuita en segundos — solo pagas al confirmar. Los fallos se reembolsan automáticamente.
Durante dos décadas, cada resultado de Google ocultaba un enlace Caché: una instantánea de la página tal como Googlebot la vio por última vez. Era la solución estándar cuando una página daba 404 cinco minutos antes de una reunión. En febrero de 2024, el Search Liaison de Google, Danny Sullivan, anunció que el enlace se retiraba, argumentando que la fiabilidad de las páginas había mejorado y el uso había caído. En septiembre de 2024, el operador de búsqueda cache: dejó de funcionar por completo.
Dos cosas importan sobre el momento. Primero, la caché nunca fue un archivo: contenía exactamente una versión, la del rastreo más reciente, y la sobrescribía constantemente. Perderla nos costó el caso de uso de «eliminado esta mañana», no nada histórico. Segundo, el mismo mes que murió la caché, Google añadió enlaces al Wayback Machine dentro de su panel Acerca de este resultado. Haz clic en los tres puntos junto a cualquier resultado, elige Más sobre esta página, y Google te lleva a las capturas del Internet Archive. Google señaló oficialmente a sus usuarios la herramienta que realmente hace el trabajo.

Para eliminaciones muy recientes las opciones son más escasas ahora: el Wayback rastrea páginas populares con frecuencia, archive.today guarda páginas bajo demanda, y los propios snippets de Google permanecen en los resultados durante días después de que una página muere. Eso suele ser suficiente. Apenas.
Usa Google para buscar en el índice del Wayback Machine
El Wayback Machine tiene una búsqueda de texto completo en beta, pero es inconsistente. El truco del que nadie habla: Google indexa una porción de web.archive.org por sí mismo, y Google es muy bueno buscando.
El patrón es simple: site:web.archive.org/web más un dominio, un título o, mejor aún, una frase que recuerdes textualmente. Buscar site:web.archive.org "we regret to inform you" junto al nombre de una marca saca a la luz avisos de discontinuación archivados que la propia búsqueda del Wayback no encontrará. Comunicados de prensa archivados, posts de disculpa eliminados, documentación antigua: todo es juego limpio.
Ajusta las expectativas correctamente. Google solo ha indexado una fracción de las capturas del archivo: la mayoría de esos 900 mil millones de páginas son invisibles para él. Una búsqueda sin resultados no prueba nada; significa que no está en la porción de Google del archivo, no que no esté archivado. Trata a Google como una capa de descubrimiento y al propio calendario del Wayback como la fuente de verdad.
Trucos del operador site: con Google y el Wayback Machine
Estas son las consultas que realmente ejecuto, más o menos en orden:
- site:example.com: el inventario más rápido de lo que Google aún sabe sobre un sitio moribundo. Los snippets permanecen durante días o semanas después de que las páginas dan 404.
- site:example.com inurl:blog (o /products/, /docs/): divide un dominio grande en secciones para que puedas verificar la cobertura por área.
- site:example.com filetype:pdf: whitepapers antiguos, manuales y hojas de especificaciones. Cada URL de PDF muerto va directo a la barra del Wayback.
- "frase exacta de la página eliminada": las búsquedas entre comillas encuentran copias de scrapers, citas en foros y mirrors. Cuanto más distintiva sea la frase, mejor.
- before:2019-01-01: los operadores before: y after: sesgan los resultados hacia la época que te interesa.
- site:web.archive.org/web "example.com": salta directamente a las capturas que Google ha indexado.
Una vez que tengas una URL, dos atajos ahorran tiempo de verdad. Pégala en el Wayback con web.archive.org/web/2/ seguido de la dirección: el 2 redirige a la captura más cercana en el tiempo. O usa la API de disponibilidad: archive.org/wayback/available?url=example.com/old-page devuelve la instantánea más cercana en un JSON limpio, que es exactamente lo que quieres dentro de scripts.
Cuándo gana Google y cuándo gana el Wayback Machine
Una tabla de decisión rápida:
| Tarea | Mejor herramienta | Por qué |
|---|---|---|
| Una página eliminada esta mañana | Snippets de Google más archive.today | El Wayback puede no haberla rastreado recientemente |
| Una página de 2009 | Wayback Machine | Google eliminó el listado hace años |
| Recuerdas una frase pero no la URL | La búsqueda de texto completo gana al navegar calendarios | |
| Navegar un sitio entero como se veía | Wayback Machine | Las capturas mantienen la navegación y el diseño intactos |
| Listar cada URL que un sitio haya servido | Wayback CDX API | Google limita los resultados de site: a unos pocos cientos |
| Verificar la redacción exacta de una página el año pasado | Wayback Machine | Una captura por rastreo, con marca de tiempo |

En resumen: Google encuentra agujas; el Wayback almacena pajares. Si necesitas el inventario completo de URLs en lugar de una sola página, la ruta CDX se cubre paso a paso en la guía para encontrar todas las páginas de un sitio web.
Un ejemplo práctico: cazar una página de producto de 2012 desaparecida
Escenario real de la primavera pasada. La tienda WooCommerce de un cliente había reemplazado su antiguo sitio Joomla años atrás; un distribuidor necesitaba la hoja de especificaciones de una pieza descatalogada, y las copias de seguridad del cliente estaban, en sus palabras, en algún disco duro.
- Ejecuté site:clientdomain.com filetype:pdf y site:clientdomain.com inurl:products. El sitio en vivo no tenía nada, pero un snippet persistente reveló el antiguo patrón de URL de Joomla: index.php con un ID de artículo.
- Pegué el dominio en el Wayback Machine y salté a las capturas de 2012 usando la línea de tiempo del calendario.
- Profundicé desde la captura de la página de inicio hasta la sección de productos. La primera captura tenía imágenes rotas; una captura cuatro meses después estaba completa, con el PDF enlazado y vivo.
- Verifiqué en archive.today las pocas páginas que el Wayback se había perdido.
Tiempo total: unos diez minutos. Sin los trucos de operadores, es una noche de callejones sin salida. Los movimientos son simples; saber qué herramienta responde a qué pregunta es toda la habilidad.
Un detalle que vale la pena recordar de ese trabajo: las imágenes rotas en la primera captura no se habían perdido, solo eran asíncronas. El Wayback rastrea las páginas y sus assets en momentos diferentes, así que una página capturada en marzo puede referenciar imágenes capturadas en junio. Cuando una captura parece medio vacía, no te rindas: salta unos meses hacia adelante o atrás y las piezas faltantes suelen aparecer. Los snippets de Google sufren la misma frescura escalonada, por eso un snippet puede citar un párrafo que la página actual ya no contiene.
De páginas encontradas a un sitio web funcional de nuevo
Encontrar las páginas es la parte divertida. Reconstruir un sitio a partir de capturas no lo es: clic derecho guardar como, renombrar assets, reparar rutas, y en la página cuarenta descubres que la hoja de estilos vive en una fecha de captura diferente. He visto a gente quemarse un fin de semana entero en un sitio de quince páginas.
Ese es el problema que nuestro servicio de restauración automatiza. La estimación gratuita lee el índice CDX del Wayback y te dice el conteo exacto de archivos archivados, el tamaño total y un precio fijo antes de que pagues nada. Las restauraciones son de pago por archivo con el primer archivo gratis, puedes eliminar el analytics y el código de anuncios de la época, y el sitio reconstruido se despliega en tu propio hosting con un clic, o se exporta como datos estructurados si prefieres autoalojarlo. Cuando Google y el Wayback Machine te han mostrado lo que existía, así es como lo recuperas.
Restaura tu sitio web desde la Wayback Machine
Estimación gratuita en segundos — solo pagas al confirmar. Los fallos se reembolsan automáticamente.
FAQ
¿Google aún tiene la función de página en caché?
No. Google eliminó el enlace Caché de los resultados en febrero de 2024 y desactivó el operador de búsqueda cache: más tarde ese año. Los reemplazos son el Wayback Machine para cualquier cosa histórica y archive.today para instantáneas bajo demanda de páginas en vivo.
¿Puedo buscar en el Wayback Machine a través de Google?
Sí: usa site:web.archive.org con un dominio o una frase entre comillas. Google solo indexa una fracción de las capturas del archivo, así que trata los resultados vacíos como no indexados por Google, nunca como prueba de que una captura no existe. Verifica en el propio calendario del Wayback para estar seguro.
¿Cómo veo versiones antiguas de una página directamente desde los resultados de Google?
Haz clic en los tres puntos junto a cualquier resultado y abre Acerca de este resultado, luego Más sobre esta página. Desde septiembre de 2024, Google enlaza directamente a las capturas del Wayback Machine del Internet Archive de esa URL desde este panel.
¿Por qué el operador site: no muestra cada página de un sitio web?
El operador site: devuelve una muestra, no un volcado de base de datos: Google típicamente limita los resultados visibles a unos pocos cientos y solo muestra lo que ha indexado. Para un inventario completo de URLs, combina el sitemap del sitio con la API CDX del Wayback.
¿Qué reemplazó al operador cache:?
Nada oficial de Google. El equivalente programático más cercano es la API de disponibilidad del Wayback (archive.org/wayback/available?url=...), que devuelve la captura más cercana de cualquier URL en formato JSON y funciona muy bien dentro de scripts.
¿Con qué frecuencia rastrea el Wayback Machine una página?
Depende de la prominencia de la página y sus enlaces entrantes. Las portadas de noticias importantes se capturan muchas veces al día; una página oscura puede ser rastreada una vez al año o nunca. Puedes forzar una captura en cualquier momento con el cuadro Save Page Now en web.archive.org.
Guías relacionadas

web cache
Caché web explicado: cómo funcionan las cachés y cómo usar una
Qué es una caché web, cómo funcionan las cachés del navegador, CDN, motores de búsqueda y archivos, y cómo usar una caché web para ver una página que ha desaparecido.

wayback machine
Wayback Machine: La guía completa para navegar por el historial web
Wayback Machine archiva más de 900 mil millones de páginas web. Aprende cómo funcionan los rastreos, las capturas, el calendario y la sintaxis de búsqueda, y cómo restaurar un sitio perdido.

find all pages on a website
Cómo encontrar todas las páginas de un sitio web (incluso las eliminadas)
¿Necesitas encontrar todas las páginas de un sitio web, incluidas las que nadie enlaza? Compara sitemaps, rastreadores, la API CDX del Wayback Machine y exportaciones de Search Console.

search website history
Cómo Buscar el Historial de un Sitio Web Antes de Comprar un Dominio
Busca el historial de un sitio web antes de comprar un dominio: instantáneas antiguas, cambios de propiedad, lastre de spam y trampas de marcas registradas, un flujo de trabajo de diligencia debida de 30 minutos.
