Wayback Machine: Panduan Lengkap Menelusuri Sejarah Web
Oleh tim editorial Restorix · 30 April 2026 · 7 menit baca

Pulihkan situs Anda dari Wayback Machine
Estimasi gratis dalam hitungan detik — Anda hanya membayar saat konfirmasi. Pemulihan gagal dikembalikan otomatis.
Wayback Machine sudah berkali-kali menyelamatkan saya. Toko WooCommerce klien terhapus karena pembaruan plugin yang bermasalah. Halaman harga pesaing dari tahun 2019, diperlukan untuk sengketa kontrak. Versi asli artikel yang diam-diam ditulis ulang setelah dikutip dalam gugatan. Ini adalah memori web, dan gratis untuk digunakan. Namun kebanyakan orang hanya menyentuh kotak pencarian di beranda dan melewatkan semuanya. Panduan ini mencakup cara kerja arsip yang sebenarnya, setiap trik pencarian yang layak diketahui, kelemahannya, dan apa yang harus dilakukan saat menjelajahi snapshot tidak cukup dan Anda membutuhkan situs itu sendiri kembali.
Apa Sebenarnya Wayback Machine Itu
Wayback Machine adalah arsip publik gratis halaman web, dikelola oleh Internet Archive, perpustakaan digital nirlaba yang berbasis di San Francisco. Brewster Kahle mendirikan organisasi ini pada tahun 1996, dan Wayback Machine dibuka untuk publik pada tahun 2001. Nama ini merujuk pada mesin WABAC, alat perjalanan waktu dari kartun tahun 1960-an Peabody's Improbable History, itulah mengapa banyak orang keliru mengingatnya sebagai 'the way back machine'.
Koleksinya telah melampaui 900 miliar halaman web yang diarsipkan dan terus bertambah lebih dari satu miliar halaman per minggu. Selain halaman web, Internet Archive menyimpan buku hasil pemindaian, berita TV, audio, dan perangkat lunak lama yang bisa dijalankan di browser. Menjelajah gratis dan tanpa perlu akun.
Satu perbedaan penting sebelum melangkah lebih jauh: Wayback Machine mengarsipkan halaman, bukan situs. Setiap snapshot adalah satu URL yang ditangkap pada satu momen. Tidak ada objek 'seluruh situs, Maret 2015' yang disimpan di rak, hanya ribuan tangkapan halaman individu yang kebetulan berbagi domain. Ingatlah hal itu, karena itu menjelaskan hampir setiap keanehan yang akan Anda temui nanti.
Bagaimana Crawl dan Snapshot Bekerja
Pulihkan situs Anda dari Wayback Machine
Estimasi gratis dalam hitungan detik — Anda hanya membayar saat konfirmasi. Pemulihan gagal dikembalikan otomatis.
Arsip dibangun oleh crawler. Pada tahun-tahun awalnya, Internet Archive mengandalkan data crawl dari Alexa Internet, perusahaan analitik web yang ikut didirikan Kahle; saat ini ia menjalankan operasi crawler sendiri, ditambah crawl dari mitra dan jutaan penyimpanan manual dari pengguna. Crawler meminta URL, menyimpan HTML yang diterima, lalu mengambil aset yang dirujuk HTML tersebut, gambar, stylesheet, skrip, masing-masing disimpan sebagai file sendiri.
Detail terakhir itu menjelaskan kebingungan yang paling umum. Snapshot bukanlah folder yang dibekukan dalam waktu. HTML halaman mungkin dari 3 Maret, sedangkan stylesheet-nya dari 9 Maret dan gambar hero dari 20 Februari. Ketika semuanya cocok, halaman akan ditampilkan dengan baik. Jika tidak, Anda mendapatkan snapshot rusak klasik: teks utuh, tata letak berantakan, kotak abu-abu di tempat foto seharusnya.
Seberapa sering halaman di-crawl
Tidak ada jadwal yang bisa diandalkan. Frekuensi crawl mengikuti popularitas: beranda surat kabar besar ditangkap ribuan kali sehari, sementara forum phpBB tahun 2009 mungkin muncul dua kali dalam satu dekade. Jika suatu halaman penting bagi Anda, jangan tunggu crawler peduli, simpan sendiri, trik yang dibahas beberapa bagian ke bawah.
Apa yang bisa menghalangi crawl
Crawler mematuhi robots.txt, dan pengecualian dapat berlaku secara retroaktif: situs yang menerapkan disallow menyeluruh pada domainnya dapat membuat seluruh riwayat tangkapannya offline hingga blokir dicabut. Pemilik situs juga dapat meminta Internet Archive secara langsung untuk mengecualikan konten mereka. Halaman di balik login dan paywall tidak pernah di-crawl sejak awal.
Membaca Kalender dan Linimasa
Cari URL dan Anda akan sampai pada tampilan kalender. Dua instrumen melakukan semua pekerjaan. Grafik batang di atas menunjukkan tangkapan per tahun, cara cepat untuk melihat kapan suatu situs aktif, kapan sibuk, dan kapan mati. Kalender di bawah menandai setiap hari yang ditangkap dari tahun yang dipilih.
- Lingkaran biru: tangkapan normal yang mengembalikan 200 OK.
- Lingkaran hijau: tangkapan adalah redirect. Crawler mengikutinya, jadi periksa ke mana arahnya.
- Tanda merah: respons error, biasanya 404 atau 500. Jarang layak dibuka.
- Lingkaran lebih besar: lebih banyak tangkapan pada hari itu. Arahkan kursor ke hari untuk waktu yang tepat, klik stempel waktu untuk membukanya.
Buka snapshot dan spanduk muncul di bagian atas halaman. Spanduk tersebut berisi stempel waktu UTC yang tepat, panah untuk tangkapan sebelumnya dan berikutnya, serta panel 'Tentang tangkapan ini' dengan metadata crawl. Saat Anda mencari perubahan tertentu, misalnya, kapan perusahaan menghapus klausul pengembalian dana, jangan klik hari secara acak. Cari kluster dan celah, lalu batasi perubahan antara tangkapan terakhir yang memilikinya dan tangkapan pertama yang tidak.

Sintaks Pencarian Wayback Machine yang Layak Dihafal
Kotak pencarian beranda adalah cara paling lambat. URL itu sendiri adalah antarmuka yang sebenarnya, dan segelintir pola mencakup hampir semua yang Anda perlukan.
| Pola | Fungsi | Contoh |
|---|---|---|
| web.archive.org/web/2020/URL | Tangkapan terdekat dengan 1 Januari 2020 | web.archive.org/web/2020/example.com |
| web.archive.org/web/20200615143000/URL | Tangkapan terdekat dengan detik tertentu (UTC, YYYYMMDDhhmmss) | web.archive.org/web/20200615143000/example.com |
| web.archive.org/web/*/URL | Kalender setiap tangkapan halaman tersebut | web.archive.org/web/*/example.com/pricing |
| web.archive.org/web/*/domain/* | Setiap URL yang ditangkap di bawah domain, dapat difilter | web.archive.org/web/*/example.com/* |
| web.archive.org/web/2020id_/URL | File asli, tanpa spanduk, tanpa tautan yang ditulis ulang | web.archive.org/web/2020id_/example.com |
| web.archive.org/web/2020im_/URL | Hanya aset gambar pada stempel waktu itu | web.archive.org/web/2020im_/example.com/logo.png |
Dua di antaranya layak disebut khusus. Daftar URL seluruh domain adalah cara tercepat untuk menemukan halaman yang alamatnya setengah Anda ingat, ketikkan fragmen slug ke kotak filter dan arsip mempersempit ribuan jalur menjadi satu posting yang Anda butuhkan. Dan pengubah id_ adalah yang digunakan profesional saat mereka membutuhkan file itu sendiri daripada pratinjau yang dibingkai ulang, karena menyajikan byte asli tanpa spanduk dan tanpa menulis ulang satu tautan pun.
Simpan Halaman Sekarang dan Saat Menolak
Arsip bukan hanya ruang baca. Save Page Now menulis ke dalamnya: tempelkan URL publik apa pun ke web.archive.org/save dan crawler mengambil halaman langsung dalam hitungan detik. Akun gratis membuka fitur tambahan seperti menyimpan halaman yang ditautkan dan tangkapan layar halaman penuh. Jika Anda menerbitkan sesuatu yang penting, menyimpannya di hari yang sama adalah asuransi termurah di internet.
Ia menolak lebih sering dari yang diperkirakan orang. Halaman yang diblokir oleh robots.txt tidak akan disimpan. Penggunaan anonim dibatasi kecepatan, sehingga menyimpan lima puluh halaman sekaligus akan terhenti. Layar login disimpan sebagai layar login. Dan aplikasi JavaScript berat terkadang diarsipkan sebagai cangkang kosong, HTML tersimpan dengan baik, tetapi konten hanya ada setelah skrip dijalankan, dan skrip tersebut meminta API yang sudah lama mati.
Di Mana Wayback Machine Kurang
- Apa pun di balik login, paywall, atau formulir POST tidak akan pernah diarsipkan.
- Aplikasi interaktif yang merender dengan JavaScript sering bertahan sebagai cangkang kosong.
- Video dan audio streaming jarang diputar dari tangkapan lama.
- Celah. Satu minggu yang sangat Anda butuhkan pasti adalah minggu yang tidak di-crawl siapa pun.
- Tidak ada unduhan seluruh situs. Anda menjelajah satu halaman dalam satu waktu, dengan tautan ditulis ulang untuk mengarah kembali ke arsip.
- Kode sisi server lenyap selamanya. Snapshot menyimpan HTML yang dirender; PHP, database, dan panel admin tidak pernah publik, sehingga tidak pernah diarsipkan.
Semua ini bukan bug. Arsip dibangun untuk memori, bukan untuk migrasi, dan perbedaan itu penting saat tujuan Anda berubah dari membaca halaman lama menjadi membangun ulang seluruh situs web.
Dari Wayback Machine ke Situs yang Dipulihkan
Menjelajahi snapshot menjawab pertanyaan. Ia tidak memberikan Anda situs web. Tautan mengarah kembali ke archive.org, aset disajikan dari server arsip, dan tidak ada tombol ekspor. Menyalin secara manual berfungsi untuk satu atau dua halaman; toko dengan 3.000 halaman yang disalin dengan cara itu adalah bulan dalam hidup Anda yang tidak akan kembali. Inilah titik di mana orang berhenti meneliti dan mulai mencari pemulihan Wayback Machine sebagai gantinya.
Kesenjangan itulah yang Restorix dirancang untuk mengatasinya. Ia mengambil setiap file arsip dari sebuah domain, membangun ulang tautan internal yang berfungsi, dan menampilkan perkiraan gratis terlebih dahulu, jumlah file yang tepat, ukuran total, dan harga tetap sebelum Anda membayar apa pun. Pemulihan dibayar per file, file pertama gratis, dan pemulihan yang gagal akan dikembalikan secara otomatis ke saldo Anda. Opsi mencakup bagian-bagian tidak glamor yang penting: menghapus skrip analitik dan iklan lama, mengonversi tautan ke relatif, memaksakan HTTPS, menjaga redirect 301 tetap hidup, dan mengekspor data artikel terstruktur sebagai XML, CSV, atau JSON.

Saat file siap, satu klik menyebarkannya ke VPS Anda sendiri melalui SSH atau SFTP, ke hosting bersama melalui FTP, atau ke bucket S3, dan setiap penyebaran menyertakan CMS file tunggal kecil di /webarchive-cms.php, sehingga situs yang dipulihkan dapat diedit begitu tiba. Tutorial memandu menjalankan semuanya dalam waktu sekitar sepuluh menit.
Pulihkan situs Anda dari Wayback Machine
Estimasi gratis dalam hitungan detik — Anda hanya membayar saat konfirmasi. Pemulihan gagal dikembalikan otomatis.
FAQ
Apakah Wayback Machine legal digunakan?
Menjelajah itu legal, dan arsip beroperasi sebagai perpustakaan. Hak cipta tetap berlaku untuk apa yang Anda lakukan dengan konten, membaca halaman lama tidak masalah, menerbitkan ulang teks orang lain secara keseluruhan tidak. Memulihkan situs Anda sendiri, atau konten yang Anda pegang haknya, adalah kasus yang umum dan aman.
Seberapa jauh ke belakang Wayback Machine bisa melacak?
Data crawl dimulai pada tahun 1996, jadi tangkapan tertua berusia hampir tiga dekade. Namun, cakupan dari tahun 1990-an jarang; hal-hal mulai padat secara andal dari pertengahan 2000-an dan seterusnya.
Mengapa snapshot kehilangan gambar atau gayanya?
Setiap aset ditangkap secara terpisah, dan beberapa tidak pernah diambil, diblokir oleh robots.txt, disajikan dari domain lain, atau sekadar terlewatkan hari itu. HTML selamat; tampilannya tidak. Coba tangkapan beberapa hari sebelumnya atau sesudahnya.
Dapatkah saya mengunduh seluruh situs web dari Wayback Machine?
Arsip itu sendiri tidak memiliki tombol unduh situs. Anda dapat menyimpan halaman satu per satu, atau menggunakan layanan pemulihan seperti Restorix yang menyusun ulang seluruh domain, panduan kami untuk [mengunduh seluruh situs web dari archive.org](/id/download-entire-website-from-archive-org) membahas setiap opsi.
Bagaimana cara menghapus situs saya sendiri dari Wayback Machine?
Tambahkan disallow untuk crawler ia_archiver di robots.txt, atau kirim permintaan pengecualian ke Internet Archive. Blokir dapat menyembunyikan tangkapan masa lalu juga, tidak hanya yang akan datang.
Apakah Wayback Machine mengarsipkan media sosial?
Sebagian. Posting dan profil publik ditangkap, tetapi feed yang dibangun berdasarkan login dan gulir tak terbatas diarsipkan dengan buruk. Anggap tangkapan sosial sebagai temuan keberuntungan, bukan catatan yang dapat diandalkan.
Panduan terkait

wayback
Cara Menggunakan Wayback Setiap Hari: Halaman Hilang, Tautan Mati, Klaim Lama
Wayback adalah cara tercepat untuk memulihkan halaman yang hilang, mengecek apa yang dikatakan sebuah situs tahun lalu, mengutip tautan mati, atau memeriksa perusahaan sebelum Anda membayar. Begini caranya.

the way back machine
Mesin Way Back: Apa Itu dan Mengapa Ada
Mencari 'the Way Back Machine'? Anda menemukannya, secara resmi bernama Wayback Machine. Inilah apa itu, siapa yang membuatnya, dan apa yang bisa dan tidak bisa dilakukannya.

wayback machine restore
Pemulihan Wayback Machine: 4 Jebakan dan Cara Menghindarinya
Pemulihan Wayback Machine bisa gagal tanpa disadari: halaman parkir, rantai pengalihan, gambar hilang, stempel waktu campuran. Cara mengenali setiap jebakan dan menghindarinya.

download entire website from archive org
Unduh Seluruh Situs Web dari Archive.org, Bukan Hanya Halaman Utama
Untuk mengunduh seluruh situs web dari archive.org, Anda membutuhkan setiap halaman, gambar, dan stylesheet. Aset tersembunyi di balik timestamp yang berbeda, berikut alasannya, beserta checklist lengkap.
