Wayback Machine no Archive.org: Um Guia Prático do Site
Por a equipe editorial da Restorix · 6 de junho de 2026 · 8 min de leitura

Restaure seu site a partir da Wayback Machine
Estimativa gratuita em segundos — você só paga ao confirmar. Falhas são reembolsadas automaticamente.
Ao pesquisar pela Wayback Machine, o Archive.org te coloca em uma página inicial repleta de ícones, livros, shows, notícias de TV, jogos de MS-DOS. Em algum lugar ali está o arquivo web que você veio buscar. Este é um guia prático: onde a Wayback fica dentro do Archive.org, como funcionam as visões de busca e calendário, alguns truques de URL que economizam tempo de verdade, e o que fazer quando olhar uma página antiga não é o mesmo que recuperá-la.
Onde a Wayback Machine Fica no Archive.org
Archive.org é a biblioteca inteira; a Wayback Machine é uma coleção dentro dela, a coleção web. A caixa de busca da página inicial é uma busca de catálogo: encontra itens como livros, vídeos e áudio por título e descrição. Cole uma URL ali esperando snapshots antigos e você recebe resultados confusos sobre livros com nomes parecidos. Todo mundo faz isso uma vez.
A Wayback tem seu próprio endereço em web.archive.org, acessível pelo grande ícone Web na página inicial do archive.org. A regra de ouro: procurando uma página web, comece em web.archive.org. Procurando uma coisa, um livro, um show, um filme, comece em archive.org. Confundir os dois é o principal motivo pelo qual as pessoas concluem que o arquivo não tem algo que ele absolutamente tem.
Buscando na Wayback Machine do Archive.org
Restaure seu site a partir da Wayback Machine
Estimativa gratuita em segundos — você só paga ao confirmar. Falhas são reembolsadas automaticamente.
Cole uma URL completa na caixa da Wayback, o protocolo é opcional, e você cai na visão de calendário daquele endereço. A partir daí:
- Escolha um ano no gráfico de barras no topo. A altura das barras mostra o volume de capturas, então os anos mais ativos do site ficam visíveis de relance.
- No próprio calendário, círculos marcam os dias com capturas; círculos maiores significam múltiplas capturas. Passe o mouse para ver os timestamps exatos.
- Clique em um timestamp para carregar aquela captura. A barra de ferramentas da Wayback aparece no topo da página, com setas para as capturas anterior e seguinte da mesma URL.
Três atalhos que valem memorizar. Primeiro, curingas: web.archive.org/web/*/example.com abre a lista de URLs de um domínio inteiro, a forma mais rápida de encontrar uma página que você esqueceu que existia. Segundo, notação de data: web.archive.org/web/2015/example.com redireciona para a captura mais próxima daquela data, e mais dígitos refinam ainda mais (20150615 fixa em meados de junho). Terceiro, o modificador id_: web.archive.org/web/20150615000000id_/http://example.com/style.css retorna o arquivo original bruto sem reescrita da Wayback, a forma limpa de pegar um stylesheet ou imagem intacto.
Comparar Duas Capturas
A visão Changes, acessível pela página de calendário, coloca duas capturas lado a lado e destaca o que mudou entre elas, adições e remoções, página por página. Em páginas longas fica confuso, mas para identificar quando um plano de preços ou um aviso de rodapé apareceu, é melhor que ficar alternando entre duas abas. Escolha capturas com alguns meses de diferença; comparar 2010 com 2025 vai pintar a tela inteira.
Salvar uma Página Você Mesmo
A caixa de salvar em web.archive.org/save arquiva qualquer página pública sob demanda, geralmente em menos de um minuto. Usuários logados ganham extras como salvar outlinks em uma passada e manter uma lista pessoal de salvamentos. Use após lançamentos, redesenhos e migrações, os momentos em que você mais provavelmente vai querer um registro datado depois.
Lendo uma Captura Sem Se Enganar
Capturas antigas mentem de formas sutis. Uma página que renderiza normalmente diz que o HTML e seus assets sobreviveram. Um esqueleto cru, sem estilo, significa que o stylesheet não foi capturado ou foi bloqueado. Caixas cinza onde deveriam haver imagens: mesma história. Nada disso significa que a página não foi arquivada, significa que o arquivo guardou o documento e perdeu alguns anexos.
O timestamp na barra de ferramentas merece mais respeito do que recebe. Uma única página renderizada pode combinar assets de capturas feitas com semanas de diferença, porque o arquivo serve a cópia disponível mais próxima de cada arquivo. Para qualquer coisa que sirva de evidência, anote a data de captura de cada elemento em vez de assumir que a página inteira é um único momento congelado.
Fique de olho na barra de URL enquanto navega por uma captura. Cada link em uma página arquivada é reescrito para apontar para a captura mais próxima daquele destino, e é por isso que você pode navegar num site morto como se ele ainda estivesse no ar, e por que um link copiado da Wayback é um endereço archive.org, não o original.

As Coleções ao Redor da Wayback
Já que você está no site de qualquer forma, o resto da biblioteca vale dez minutos. Os ícones da página inicial dividem tudo por tipo de mídia:
- Textos: dezenas de milhões de livros e documentos digitalizados, incluindo empréstimos do Open Library e downloads gratuitos de domínio público.
- Áudio: gravações de shows do Live Music Archive, rádio antiga, podcasts e discos 78 rpm digitalizados.
- Vídeo: um arquivo de notícias de TV com legendas pesquisáveis, mais a gloriosamente excêntrica coleção Prelinger de filmes educacionais e industriais.
- Software: milhares de títulos de MS-DOS, arcade e console jogáveis num emulador no navegador. Reserve uma tarde primeiro.
Cada coleção tem sua própria busca, filtros e, ao contrário do lado web, opções generosas de download.
As coleções se cruzam de forma elegante, também. Uma revista de computador digitalizada pode avaliar um programa que você pode então abrir no emulador, e legendas de notícias de TV ficam a um clique de capturas web relacionadas. Vale a pena explorar sem rumo.
O Que a Wayback Machine no Archive.org Não Vai Te Entregar
O lado web do Archive.org é feito para visualização, e seus limites aparecem rápido quando você o trata como fonte de arquivos. Não há download em massa para capturas. Formulários, caixas de busca e logins estão mortos, o arquivo armazena respostas GET, não sessões. Qualquer coisa atrás de login nunca foi rastreada. Proprietários podem solicitar exclusão, então alguns domínios estão ausentes por pedido. E páginas pesadas em JavaScript de meados dos anos 2010 em diante frequentemente capturaram nada além de um spinner de carregamento.
Um caso concreto: um fórum phpBB de 2009 com 40.000 posts. A Wayback mostra os tópicos públicos, espalhados por anos de capturas. O Salvar Como do navegador produz páginas com URLs reescritas do archive.org, avatares faltando e sem anexos. Apontar o wget para web.archive.org é lento, tem limite de taxa, e ainda te entrega HTML encapsulado pela Wayback a menos que você reescreva cada URL manualmente. Isso é uma noite de trabalho por subfórum, para um resultado bagunçado.
Saindo com Arquivos Reais
Quando o objetivo é republicar ou manter uma cópia local, use um extrator feito para isso. O Restorix extrai a versão arquivada de um domínio da Wayback e a reconstrói como arquivos limpos. A estimativa gratuita te dá a contagem exata de arquivos arquivados, o tamanho total e um preço travado antes de você pagar qualquer coisa. A partir daí você paga por arquivo restaurado, o primeiro é grátis, e nada é recorrente, com opções de limpeza que removem rastreadores antigos, anúncios e iframes, tornam os links internos relativos e convertem o site para HTTPS. Você pode baixar o resultado, exportar artigos como XML, CSV ou JSON, ou publicar direto na sua hospedagem com um pequeno CMS incluso.
Para o fluxo completo de download, o guia sobre baixar um site do Archive.org percorre tudo passo a passo, e o artigo sobre downloader da Wayback compara as principais abordagens.

Um Guia de Bolso da Wayback Machine no Archive.org
Guarde este conjunto, ele cobre a maior parte do que as pessoas perguntam sobre o site:
| Você quer… | Faça isto |
|---|---|
| Ver versões antigas de uma página | Cole a URL em web.archive.org |
| Listar URLs capturadas de um domínio | Abra web.archive.org/web/*/example.com e use a visão de URLs |
| Ir para a captura mais próxima de uma data | Use web.archive.org/web/20150615/http://example.com |
| Obter um arquivo bruto, sem reescrita | Adicione id_ após o timestamp na URL de captura |
| Arquivar uma página agora | Envie em web.archive.org/save |
| Buscar livros, áudio ou vídeo | Use a busca de catálogo no próprio archive.org |
Restaure seu site a partir da Wayback Machine
Estimativa gratuita em segundos — você só paga ao confirmar. Falhas são reembolsadas automaticamente.
FAQ
A Wayback Machine faz parte do Archive.org?
Sim. Archive.org é o site da Internet Archive, e a Wayback Machine é sua coleção web, acessível em web.archive.org ou pelo ícone Web na página inicial. Mesma organização, mesma entidade sem fins lucrativos, e uma conta funciona em todo o site.
Até quando a Wayback Machine no Archive.org remonta?
Até 1996, ano em que a Internet Archive começou a rastrear. A cobertura do final dos anos 1990 é mais escassa e limitada principalmente a sites maiores; ela fica consideravelmente mais densa a partir dos anos 2000, conforme os rastreamentos foram escalando.
Preciso de uma conta para usar a Wayback Machine no Archive.org?
Não é preciso conta para navegar pelas capturas ou salvar páginas pelo Save Page Now. Uma conta gratuita adiciona conveniências como gerenciar suas páginas salvas e emprestar livros do Open Library. Não há plano pago para a própria Wayback.
Por que o calendário mostra uma captura mas a página carrega quebrada?
O HTML foi capturado mas alguns assets não, stylesheets, imagens ou scripts rastreados em outro momento, bloqueados por regras de robots, ou servidos a partir de domínios que depois saíram do ar. Tente uma data de captura próxima; uma semana antes ou depois costuma renderizar completo.
Posso buscar pelo texto completo de páginas web antigas no Archive.org?
Não na Wayback Machine, ela indexa URLs, não o texto das páginas. Para texto, a busca de catálogo de itens cobre livros e documentos com OCR completo. Se você só lembra de uma frase de uma página morta, um buscador geral mais o nome do domínio costuma ser o caminho mais rápido para a URL certa.
Como faço para baixar um site inteiro do Archive.org?
A Wayback Machine não tem exportação em massa. O caminho prático é um serviço de restauração: o Restorix extrai todos os arquivos arquivados de um domínio, limpa a marcação e te entrega uma cópia para download, veja o [guia de download de site inteiro](/pt/download-entire-website-from-archive-org).
Guias relacionados

internet archive way back machine
Internet Archive Way Back Machine: Um Guia para Webmasters
Como o Internet Archive Way Back Machine funciona, a organização sem fins lucrativos que o mantém, o que significam mais de 900 bilhões de páginas arquivadas e como os webmasters o utilizam no dia a dia.

archiveorg
Archiveorg: Dentro da Maior Biblioteca Gratuita da Internet
Archiveorg é mais que a Wayback Machine: livros gratuitos, shows ao vivo, telejornais, software jogável e mais de 900 bilhões de páginas web. Tour completo, além de recuperação de arquivos.

download a website from archive org
Como baixar um site do Archive.org: 3 formas que funcionam
Três formas comprovadas de baixar um site do archive.org: salvar páginas manualmente, usar scripts na API CDX ou rodar uma restauração automatizada. Estimativas realistas de tempo para cada uma.

restore website from archive.org
Restaurar um site do Archive.org: faça você mesmo ou pronto para usar?
Devo restaurar um site do Archive.org sozinho ou pagar por um serviço pronto? Uma comparação honesta de custo, tempo, habilidade e risco, com um framework de decisão.
