Wayback Machine y sitios web históricos: donde vive la web antigua
Por el equipo editorial de Restorix · 4 de julio de 2026 · 10 min de lectura

Restaura tu sitio web desde la Wayback Machine
Estimación gratuita en segundos — solo pagas al confirmar. Los fallos se reembolsan automáticamente.
En octubre de 2009, Yahoo cerró GeoCities. Millones de páginas personales hechas a mano, archivos MIDI, GIFs en construcción, altares a series de televisión olvidadas, fueron marcadas para eliminarse con apenas unos meses de aviso. Un grupo de voluntarios llamado Archive Team pasó esos meses scrapeando tan rápido como los servidores de Yahoo lo permitían y publicó el botín como torrent. Ese rescate es la razón por la que los sitios web históricos son algo que aún puedes visitar en lugar de solo recordar.
La frase de búsqueda es torpe, wayback machine, sitios web históricos, en cualquier orden en que caigan las palabras, pero la pregunta detrás es simple: ¿dónde vive la web antigua y aún se puede ver? Se puede. Aquí tienes un recorrido por los lugares que la conservan, desde los cientos de miles de millones de capturas del Wayback Machine hasta un sitio que te permite navegar 1997 dentro de un Netscape Navigator emulado. Y al final, la parte práctica: cómo levantar una pieza de esa historia del estante del museo y volver a ponerla en línea bajo tu propio dominio.
¿Qué cuenta como sitio web histórico?
Se mezclan tres cosas diferentes. Primero, los grandes archivos de rastreo, el Wayback Machine y sus primos de bibliotecas nacionales, que capturan páginas según un calendario. Segundo, las colecciones rescatadas: plataformas muertas como GeoCities, Tripod o AOL Hometown, guardadas en bloque antes del cierre y rehospedadas por voluntarios. Tercero, los museos vivos: proyectos como oldweb.today que no solo almacenan las páginas, sino que recrean la experiencia de navegarlas, con la interfaz de navegador de la época incluida.
La necesidad no es sentimental. Un estudio de Pew Research de 2024 descubrió que el 38 % de las páginas web de 2013 ya no eran accesibles una década después. Las páginas no desaparecen porque alguien decida que la historia terminó. Desaparecen porque vence una tarjeta de crédito, una empresa es adquirida, una actualización del CMS sale mal. Los sitios web históricos son la red de seguridad para un medio que no tiene edición impresa.
El material que vale la pena preservar suele caer en unas pocas categorías:
- HTML codificado a mano antes de 2010, diseños con tablas, spacer GIFs, libros de visitas
- Plataformas muertas: GeoCities, Tripod, Angelfire, blogs de MySpace, Google+
- Comunidades de foros en phpBB y vBulletin, a menudo el único registro de un hobby de nicho
- Blogs y fotoblogs tempranos, anteriores a las redes sociales
- Sitios extintos de pequeños negocios y clubes, la historia local que nadie más archivó
Cómo el Wayback Machine se convirtió en la mayor colección de sitios web históricos
Restaura tu sitio web desde la Wayback Machine
Estimación gratuita en segundos — solo pagas al confirmar. Los fallos se reembolsan automáticamente.
El Internet Archive, fundado por Brewster Kahle en 1996, abrió el Wayback Machine al público en 2001. Hoy alberga cientos de miles de millones de capturas de páginas y sigue siendo la respuesta predeterminada a 'cómo se veía este sitio hace cinco años'. La vista de calendario muestra la densidad de capturas de un vistazo; el timemap lista cada instantánea de una URL; Save Page Now permite a cualquiera archivar la página que está viendo, razón por la cual gran parte de la web reciente queda cubierta en minutos tras una noticia de última hora.
Dos trucos que vale la pena conocer. Añade id_ a una marca de tiempo en la URL, web.archive.org/web/20090601id_/http://example.com, y obtendrás el archivo original exactamente como fue rastreado, sin el banner inyectado del archivo ni los enlaces reescritos. Y la API CDX listará todas las capturas de un patrón de URL, que es como los profesionales inventarían un sitio entero muerto antes de tocarlo.
Los vacíos también importan. Históricamente, el Wayback Machine respetaba robots.txt, por lo que algunos sitios antiguos tienen cobertura escasa. Las páginas con mucho JavaScript a menudo capturan solo la carcasa, no el contenido. Las imágenes y archivos alojados en otros dominios se pierden. Cuando una captura parece rota, el primer movimiento es probar capturas unos meses antes o después, la calidad de cobertura varía enormemente entre fechas.
GeoCities y los proyectos de rescate que se negaron a dejarlo morir
GeoCities era el tercer sitio más visitado de la web cuando Yahoo lo compró en 1999. Diez años después Yahoo lo cerró, y el scrape de emergencia de Archive Team se convirtió en uno de los mayores actos de preservación digital jamás realizados por voluntarios. Los datos sobreviven en lugares como oocities.org y geocities.ws, que rehospedan las páginas rescatadas, y GifCities, el buscador del Internet Archive para los GIFs animados extraídos de la colección. Deleted City, de Richard Vijgen, renderiza el archivo como un mapa ampliable, barrios incluidos, y Cameron's World lo remezcla en un collage homenaje.
Dos衍生aciones merecen mención especial. One Terabyte of Kilobyte Age, el blog de investigación de Olia Lialina y Dragan Espenschied, lleva años publicando capturas de pantalla y ensayos sobre la colección, lo más parecido que tiene la web antigua a un programa curatorial. Y Neocities, fundado en 2013, es el sucesor vivo: no un archivo, sino un alojamiento gratuito donde la gente vuelve a construir páginas personales codificadas a mano, con la estética GeoCities incluida.

La lección de GeoCities es incómoda: nada alojado por otro es permanente, sin importar cuán grande sea la empresa. Yahoo era el gigante de la web. La plataforma sobrevivió a su caso de negocio exactamente lo que duró el periodo de aviso.
oldweb.today: navegar páginas antiguas en navegadores de la época
Una página de 1997 estaba escrita para Netscape Navigator 4 o Internet Explorer 5. Abierta en un navegador moderno, los marcos colapsan, los applets mueren, las fuentes se sustituyen y la etiqueta blink se queda ahí sin parpadear, los motores modernos se niegan. oldweb.today, creado por Ilya Kreymer de Webrecorder, resuelve esto ejecutando navegadores vintage emulados dentro de tu navegador y alimentándolos con capturas del Internet Archive y varios archivos web nacionales. Eliges Mosaic, Netscape o las primeras versiones de IE, escribes una URL y un año, y obtienes la página tal como se sentía.
Suena como una novedad hasta que lo usas para investigar. Los diseños con spacer GIF solo tienen sentido en tamaños de pantalla de la época. Los menús DHTML escritos para IE4 no hacen nada en un motor moderno. Si estudias, citas o reconstruyes sitios antiguos, renderizarlos en el navegador para el que fueron diseñados es la diferencia entre mirar un espécimen y mirar una foto de un espécimen. ArchiveWeb.page, del mismo equipo, va en la otra dirección: registra tu navegación actual en archivos WACZ estándar, para que las páginas que te importan hoy se conviertan en la historia bien preservada de alguien después.
Más allá del Wayback Machine: otros sitios web históricos que vale la pena conocer
El Wayback Machine es el más grande, no el único. La investigación seria, y la restauración seria, contrasta varios archivos, porque cada rastreador vio una porción diferente de la web.
| Archivo | En qué es bueno | Cómo se usa |
|---|---|---|
| archive.today (archive.ph) | Capturas bajo demanda; fuerte en páginas con mucho JavaScript y de noticias | Pega una URL; navega o guarda páginas individuales |
| Arquivo.pt | La web portuguesa, además de búsqueda de texto completo en páginas archivadas | Interfaz web y API abierta |
| UK Web Archive | Rastreo por depósito legal de la web británica por la British Library | Colecciones abiertas en línea; archivo completo en las salas de lectura |
| Common Crawl | Rastreos mensuales a escala de petabytes como conjunto de datos gratuito | Archivos WARC sin procesar; trae tus propias herramientas |
| Memento Time Travel | Buscar en muchos archivos a la vez por fecha | Una búsqueda que redirige a la captura más cercana en cualquier archivo |
| Library of Congress Web Archives | Colecciones temáticas curadas, elecciones, eventos, culturas web | Navegación y búsqueda en loc.gov |
Las bibliotecas nacionales merecen respeto aquí. Las leyes de depósito legal significan que la British Library, la Bibliothèque nationale de France y otras rastrean sistemáticamente los dominios de su país, a menudo capturando sitios regionales y gubernamentales que el Internet Archive vio poco o nunca.
Restaurar sitios web históricos desde el Wayback Machine
Navegar por un museo es una cosa. A veces una pieza de la historia importa lo suficiente como para devolverla a funcionamiento: el sitio de tu club de 2003, la documentación de un proyecto open source extinto, la página personal de un familiar fallecido. Una clienta vino a mí el año pasado con exactamente eso, un fotoblog llevado por su difunto padre, desconectado desde 2014. La familia quería recuperarlo en el dominio original para un aniversario.
- Encuentra la mejor captura. Usa la vista de calendario y revisa varias fechas; la más reciente no siempre es la más completa. Las imágenes se rompen de forma diferente entre capturas.
- Obtén el inventario real antes de comprometerse. La estimación gratuita de este servicio lee el archivo para tu dominio y devuelve el conteo exacto de archivos archivados, el tamaño total y un precio cerrado, antes de pagar cualquier cosa.
- Elige las opciones de restauración. La selección por rango de fechas te mantiene dentro de la mejor época del sitio; eliminar analíticas, anuncios e iframes antiguos quita la basura de terceros de 2008; los enlaces internos relativos y la conversión a HTTPS hacen que el resultado sea desplegable en cualquier lugar.
- Restaura. Pagas por archivo con una pequeña tarifa fija, el primer archivo es gratis y no hay suscripción, solo recargas de saldo puntuales.
- Despliega y mantén. El deploy con un clic sube el sitio restaurado a tu VPS, hosting compartido o S3, y el CMS de archivo único incluido permite a la familia, o al secretario del club, corregir una errata sin aprender Git.
En el caso de ese fotoblog, la estimación encontró 1.140 archivos y 210 MB, la restauración tomó menos de una hora, y el sitio ahora vive en hosting estático barato que cuesta menos al año que un ramo de flores. Las restauraciones fallidas se reembolsan automáticamente al saldo, así que el perfil de riesgo es tan emocionante como leer un recibo. El flujo completo de restauración del wayback está documentado si quieres los detalles primero.

Un enlace al museo vs ser dueño delExhibit
Enlazar a una captura del Wayback está bien para una cita o una referencia puntual. Restaurar gana cuando el contenido tiene valor continuo: tráfico de búsqueda que debería aterrizar en tu dominio, uptime que controlas, e independencia de las políticas de cualquier archivo, los archivos sí eliminan contenido a pedido, y el Wayback Machine no es la excepción. Mi regla: enlazar para notas al pie, restaurar para cualquier cosa que te daría pena perder dos veces.
Un enlace a un archivo es una promesa que otro mantiene. Una restauración es una copia en tus propias manos.
Restaura tu sitio web desde la Wayback Machine
Estimación gratuita en segundos — solo pagas al confirmar. Los fallos se reembolsan automáticamente.
FAQ
¿Son los sitios web históricos y el Wayback Machine lo mismo?
No. El Wayback Machine es la mayor colección individual, pero la frase cubre todo lo que preserva sitios antiguos: archivos de plataformas rescatadas como los espejos de GeoCities, museos vivos como oldweb.today, archivos web de bibliotecas nacionales y conjuntos de datos de investigación como Common Crawl. Contrastar varios de ellos es práctica estándar, porque cada rastreador capturó una porción diferente de la web.
¿Puedo seguir navegando GeoCities hoy?
Sí. oocities.org y geocities.ws rehospedan páginas del rescate de Archive Team de 2009, GifCities busca los GIFs animados de la colección, y oldweb.today puede servir capturas de GeoCities dentro de un navegador de época emulado. Lo que no puedes hacer es navegar en geocities.com, el original de Yahoo se ha ido para siempre.
¿Es legal restaurar un sitio antiguo desde un archivo web?
Restaurar tu propio sitio es sencillo. Restaurar el de otro es legalmente gris: el texto, las imágenes y el código archivados siguen siendo propiedad de sus dueños. La preservación y la investigación privada generalmente se toleran; republicar el contenido de un desconocido como propio, no. Cuando se puede localizar al dueño original, pregunta, en mi experiencia suelen alegrarse de que a alguien le importara.
¿Por qué las capturas antiguas muestran imágenes rotas y páginas faltantes?
El rastreador nunca las obtuvo, activos en otros dominios, bloqueos de robots.txt, o simplemente una página añadida después del último rastreo. Prueba capturas unos meses antes o después de tu fecha objetivo; la cobertura varía mucho entre instantáneas. Para trabajos de restauración, una restauración por rango de fechas extrae el conjunto más completo de archivos disponible en lugar de apostarlo todo a un solo día.
¿Hasta dónde llegan los archivos web históricos?
Los rastreos del Internet Archive comienzan en 1996. La mayoría de los archivos web nacionales comenzaron a mediados de la década de 2000, y el conjunto de datos de Common Crawl empieza en 2008. Cualquier cosa pública desde 1996 en adelante tiene buenas posibilidades de sobrevivir en algún lugar; la web anterior a 1996 sobrevive sobre todo en capturas de pantalla y recuerdos.
Guías relacionadas

historical web
La web histórica como recurso de investigación: lo que realmente vale
Cómo académicos, periodistas y abogados usan la web histórica: dónde se conservan los registros, cómo juzgar la calidad de preservación y cuándo una captura sirve como prueba.

wayback machine
Wayback Machine: La guía completa para navegar por el historial web
Wayback Machine archiva más de 900 mil millones de páginas web. Aprende cómo funcionan los rastreos, las capturas, el calendario y la sintaxis de búsqueda, y cómo restaurar un sitio perdido.

website history
Historial de un sitio web: capturas, WHOIS, DNS y las herramientas para cada caso
El historial de un sitio web puede referirse a capturas archivadas, registros WHOIS, cambios de DNS o posiciones antiguas. Descubre qué herramienta responde cada pregunta y cómo reconstruir un sitio perdido.

wayback restore
Restauración Wayback: Recupera tu sitio perdido en 5 pasos
Restauración Wayback en cinco pasos sencillos: encuentra la instantánea correcta, obtén un precio exacto antes de pagar, descarga los archivos reconstruidos y súbelos a tu hosting.
