Memulihkan Situs Web dari Archive.org: DIY atau Jasa Langsung?
Oleh tim editorial Restorix · 13 Juni 2026 · 8 menit baca

Pulihkan situs Anda dari Wayback Machine
Estimasi gratis dalam hitungan detik — Anda hanya membayar saat konfirmasi. Pemulihan gagal dikembalikan otomatis.
Ada dua cara untuk mengembalikan situs yang mati dari Archive.org. Anda bisa menghabiskan akhir pekan bergulat dengan wget dan menulis ulang tautan secara manual, atau membayar per file dan menyiapkan situs yang sudah dibersihkan untuk dideploy ke hosting Anda sambil Anda melakukan hal lain. Keduanya sah. Keduanya memiliki orang yang akan mengatakan bahwa cara lainnya salah.
Saya telah melakukan keduanya, pada segala hal mulai dari portofolio sepuluh halaman hingga forum phpBB tahun 2009 dengan 4.000 lampiran. Berikut adalah rinciannya, berapa biaya setiap cara, di mana masing-masing gagal, dan kerangka pengambilan keputusan yang tidak menganggap waktu Anda tidak berharga.
Apa yang sebenarnya Anda dapatkan saat memulihkan situs web dari Archive.org
Atur ekspektasi terlebih dahulu, karena arsip bukanlah cadangan (backup). Wayback Machine menyimpan apa pun yang bisa dilihat oleh crawler-nya: halaman HTML, serta gambar, CSS, dan JavaScript ketika itu publik dan bisa di-crawl. Itu cukup banyak, sering kali seluruh situs yang terlihat.
Apa yang tidak disimpannya: apa pun di balik login, form handler, database, indeks pencarian, dan biasanya apa pun yang dirender JavaScript saat runtime di situs yang lebih baru. Situs WordPress yang dipulihkan kembali sebagai halaman statis, bukan WordPress. Toko yang dipulihkan kembali tanpa keranjang yang berfungsi. Mana pun cara yang Anda pilih, batasan ini berlaku, layanan jasa langsung memulihkan file yang sama seperti yang Anda lakukan, hanya saja lebih cepat dan lebih bersih.
Satu ekspektasi lagi: tangkapan layar bukan jaminan. Crawler mungkin telah mengambil HTML halaman tetapi melewatkan gambar utama hari itu, atau menyimpan pengalihan alih-alih halaman tersebut. Cakupan juga menipis pada situs yang memblokir pengarsipan atau berada di balik perlindungan bot yang ketat. Namun, untuk sebagian besar situs yang publik dan tertaut, arsip ini berjalan sangat dalam, jenis halaman yang Anda lupakan pun akan kembali.
Cara DIY, langkah demi langkah
Pulihkan situs Anda dari Wayback Machine
Estimasi gratis dalam hitungan detik — Anda hanya membayar saat konfirmasi. Pemulihan gagal dikembalikan otomatis.
Rangkaian alat DIY gratis dan berfungsi. Untuk situs kecil yang sebagian besar statis, ini adalah proyek akhir pekan yang sangat masuk akal:
- Temukan snapshot Anda: gunakan kalender Wayback Machine atau CDX API untuk mencantumkan setiap URL yang ditangkap untuk domain tersebut.
- Unduh massal: jalankan alat seperti wayback-machine-downloader atau wget dengan flag mirror pada rentang tanggal yang Anda pilih. Panduan kami tentang cara mengunduh situs web dari Archive.org membahas perintahnya.
- Bersihkan markup: hapus kode toolbar yang disuntikkan oleh arsip dan ubah URL berawalan web.archive.org menjadi tautan relatif.
- Burukan aset yang hilang: gambar dan file yang dilewati crawler perlu dicari di tempat lain atau dibuat ulang.
- Uji secara lokal, lalu unggah ke hosting Anda dan perbaiki apa pun yang rusak saat pemindahan, biasanya URL absolut dan peringatan konten campuran HTTPS.
Anggarkan 10 hingga 15 menit per halaman secara keseluruhan untuk pekerjaan manual, lebih sedikit dengan alat yang bagus. Situs 30 halaman adalah satu sore. Situs 300 halaman adalah sebulan penuh malam.

Di mana pemulihan DIY salah
Pengunduhan adalah bagian yang mudah. Pembersihan adalah tempat akhir pekan mati.
- Operasi tautan: setiap href dan src mengarah ke web.archive.org. Menulis ulangnya terdengar sepele sampai Anda bertemu query string, URL yang dikodekan, dan tautan yang terkubur di dalam JavaScript.
- Gambar hilang: cakupan gambar crawler tidak merata, terutama setelah 2015. Anda mengetahuinya satu per satu, satu thumbnail rusak pada satu waktu.
- Celah senyap: halaman yang Anda lupakan ada, halaman arahan lama, arsip tag, tetap mati kecuali Anda mencantumkan setiap URL terlebih dahulu.
- Karakter rusak: situs lama yang dikodekan dalam Latin-1 kembali dengan karakter kacau ketika alat Anda mengasumsikan UTF-8.
- Jebakan 80%: 80% pertama dari situs membutuhkan 20% waktu. 20% terakhir, template aneh, frame, halaman era Flash, membutuhkan sisanya. Toko WooCommerce milik klien yang saya lihat dikutip sebagai pekerjaan cepat, ternyata memakan waktu enam minggu penuh malam bagi pemiliknya, dan pagination kategori tidak pernah berfungsi dengan baik.
Perhatikan apa yang tidak ada dalam daftar itu: pengunduhan itu sendiri. Mengambil file adalah masalah yang sudah terpecahkan. Setiap kisah kegagalan DIY yang saya dengar, dan saya sudah mendengar banyak, dimulai dengan seseorang yang meremehkan pembersihan, bukan pengunduhan.
Memulihkan situs web dari Archive.org dengan cara jasa langsung
Alat jasa langsung ada karena pembersihan dapat diotomatisasi dan pengunduhan bukanlah produknya, pembersihanlah produknya. Restorix menjalankan pemulihan untuk Anda: Anda memilih domain dan rentang tanggal, dan ia akan menarik file arsip, menulis ulang tautan, menghapus apa pun yang Anda minta untuk dihapus, dan men-deploy hasilnya.
Detail yang penting: estimasinya gratis dan menunjukkan jumlah file arsip yang tepat, ukuran total, dan harga terkunci sebelum Anda membayar apa pun, Anda membayar per file yang dipulihkan ditambah biaya tetap kecil, file pertama gratis. Opsi pemulihan mencakup bagian yang membosankan: menghapus analitik, iklan, iframe, dan tautan eksternal; minify JS dan CSS; membuat tautan internal relatif; mengkanonikalkan ke www atau non-www; menyimpan pengalihan 301 dan 302; mengubah semuanya menjadi HTTPS.
Deploy hanya dengan satu klik ke server SSH atau SFTP, hosting bersama FTP atau FTPS, atau S3, dan CMS file tunggal yang disertakan di webarchive-cms.php berarti situs yang dipulihkan tetap bisa diedit, pengeditan konten, cari dan ganti, serta file manager, dengan kata sandi admin per situs dan safe mode aktif secara default. Jika pemulihan atau deploy gagal, pengembalian dana ke saldo Anda otomatis. Isi ulang bersifat sekali jalan; tidak ada langganan yang harus Anda ingat untuk dibatalkan.
DIY vs jasa langsung: perbandingan jujur
| Faktor | DIY (wget, alat pengunduh, pembersihan manual) | Jasa langsung (Restorix) |
|---|---|---|
| Biaya | $0 untuk alat; hanya biaya hosting | Per file yang dipulihkan + biaya tetap kecil; harga terkunci pada estimasi gratis |
| Waktu | 10-15 menit per halaman; berhari-hari hingga berminggu-minggu untuk situs besar | Beberapa menit untuk konfigurasi; pekerjaan berjalan tanpa pengawasan |
| Keahlian yang dibutuhkan | Nyaman dengan command line, HTML, penulisan ulang URL | Tidak ada, pilih domain, rentang tanggal, dan opsi |
| Pembersihan tautan | Manual; menjadi penyebab utama boros waktu | Otomatis, termasuk tautan internal relatif |
| Aset yang hilang | Anda menemukannya satu kesalahan 404 pada satu waktu | Manifest file JSON atau SQLite lengkap menunjukkan apa yang ada |
| Fitur yang mati (formulir, pencarian) | Anda membangunnya kembali atau menerimanya dalam keadaan rusak | Batasan yang sama, formulir masih perlu diganti; CMS menangani pengeditan |
| Risiko jika gagal | Akhir pekan Anda | Pengembalian dana otomatis ke saldo |
Dua baris patut ditekankan. Baris waktu tidak linier, biaya DIY per halaman meningkat seiring situs menjadi lebih tua dan lebih aneh. Dan baris risiko adalah yang sering diabaikan orang: pemulihan DIY yang gagal merugikan waktu Anda, pemulihan layanan yang gagal tidak merugikan apa pun.

Cara memutuskan mana yang cocok untuk Anda
Lupakan ideologi. Keputusannya adalah aritmatika ditambah satu pertanyaan jujur tentang diri Anda.
- Di bawah 30 halaman, statis, dan Anda menyukai utak-atik seperti ini: DIY. Ini adalah proyek yang memuaskan dan benar-benar gratis.
- Lebih dari 100 halaman, atau situs apa pun dengan aset berat: jasa langsung. Perhitungan waktu per halaman cepat tidak lagi menguntungkan DIY.
- Pekerjaan klien atau tenggat waktu apa pun: jasa langsung. Harga yang terkunci dan pekerjaan tanpa pengawasan mengalahkan estimasi optimis dari waktu malam Anda sendiri.
- Tarif per jam Anda dikalikan jam DIY melebihi estimasi yang terkunci: jasa langsung. Hitung angka sebenarnya, orang-orang cenderung meremehkan waktu mereka sendiri.
- Anda ingin belajar cara kerja arsip: lakukan DIY pada situs kecil terlebih dahulu. Pengetahuannya akan berpindah, dan Anda akan menggunakan alat jasa langsung dengan penilaian yang lebih baik selamanya.
Pendekatan hibrida sering diremehkan: lakukan DIY untuk pengunduhan di situs kecil untuk memahami prosesnya, lalu bayar untuk pemulihan ketika situsnya benar-benar penting. Dan bahkan penggiat DIY yang berkomitmen pun harus menjalankan estimasi gratis, mengetahui jumlah file arsip yang sebenarnya memberi tahu Anda sebelumnya apakah rencana akhir pekan Anda memakan waktu dua jam atau dua puluh jam.
Langkah pertama untuk memulihkan situs web Anda dari Archive.org, mana pun cara yang Anda pilih
- Konfirmasi cakupan: temukan rentang tanggal di mana situs terlihat lengkap dan halaman utama memiliki snapshot.
- Pilih tanggal target Anda: era yang terbaik, belum tentu yang paling baru.
- Hitung cakupan nyata: jalankan estimasi gratis untuk mendapatkan jumlah file arsip yang tepat dan ukuran total.
- Pilih cara Anda dengan kerangka kerja di atas.
- Siapkan hosting: hosting bersama atau VPS apa pun berfungsi; deploy jasa langsung menangani SSH, SFTP, FTP, dan S3 secara langsung.
- Setelah pemulihan, klik setiap jenis halaman sekali dan perbaiki formulir yang mati sebelum Anda menganggapnya selesai. Tutorial memandu Anda melalui seluruh proses.
Pulihkan situs Anda dari Wayback Machine
Estimasi gratis dalam hitungan detik — Anda hanya membayar saat konfirmasi. Pemulihan gagal dikembalikan otomatis.
FAQ
Apakah gratis untuk memulihkan situs web dari Archive.org?
Arsip itu sendiri gratis untuk dijelajahi dan diunduh, sehingga pemulihan DIY hanya menghabiskan waktu Anda, realistisnya 10 hingga 15 menit per halaman jika Anda memasukkan pembersihan tautan. Pemulihan jasa langsung dikenakan biaya per file dengan harga terkunci yang ditunjukkan dalam estimasi gratis sebelum Anda membayar. Tidak ada cara yang menarik biaya untuk data arsip; Anda membayar, baik dengan waktu atau uang, untuk pembersihan dan pembangunan ulang.
Bisakah saya memulihkan situs web dari Archive.org yang bukan milik saya?
Secara teknis bisa untuk snapshot publik, tetapi hak cipta konten masih dimiliki oleh pemilik aslinya. Memulihkan situs lama Anda sendiri, atau milik klien dengan izin, adalah langkah yang aman. Membangun ulang bisnis orang lain dari halaman arsip mereka tidaklah aman. Pemulihan domain kedaluwarsa berada di tengah-tengah, praktik umum, tetapi jangan menyamar sebagai pemilik atau merek lama.
Berapa banyak bagian situs lama saya yang sebenarnya dimiliki arsip?
Halaman publik yang tertaut biasanya tercakup dengan baik; gambar dan skrip lebih tidak merata, dan apa pun di balik login atau formulir hilang. Satu-satunya jawaban yang dapat diandalkan adalah penghitungan tingkat file: estimasi gratis mencantumkan jumlah file arsip yang tepat dan ukuran total untuk rentang tanggal Anda, dan manifest menunjukkan dengan tepat apa yang ada sebelum Anda berkomitmen.
Apakah formulir kontak dan pencarian saya akan berfungsi setelah pemulihan?
Tidak. Pemulihan menghasilkan halaman statis, dan fitur sisi server seperti form handler dan indeks pencarian tidak pernah diarsipkan. Rencanakan untuk mengganti formulir dengan layanan formulir yang di-host atau mailto sederhana, dan anggap pencarian sebagai item yang harus dibangun ulang. Ini berlaku untuk pemulihan DIY maupun jasa langsung, siapa pun yang menjanjikan sebaliknya sedang menjual berlebihan.
DIY vs jasa langsung, mana yang menghasilkan situs yang lebih baik?
Jasa langsung, untuk apa pun yang lebih besar dari situs brosur kecil, karena penulisan ulang tautan dan pembersihan aset diterapkan secara sistematis, bukan secara manual tengah malam. DIY bisa menyamainya di situs kecil jika Anda sangat teliti. Kesenjangan yang sebenarnya adalah konsistensi: alat memperlakukan file ke-2.000 sama persis dengan file pertama. Manusia tidak.
Panduan terkait

download a website from archive org
Cara Mengunduh Situs Web dari Archive.org: 3 Metode yang Terbukti Berhasil
Tiga metode teruji untuk mengunduh situs web dari archive.org: menyimpan halaman secara manual, membuat skrip CDX API, atau menggunakan layanan pemulihan otomatis. Estimasi waktu realistis untuk setiap metode.

archive org website
Situs Archive.org: Pencarian Lanjutan, Filter & Koleksi
Kuasai situs Archive.org dengan operator pencarian lanjutan, filter, dan koleksi yang penting untuk situs web lama, ditambah kapan harus menggunakan alat pemulihan.

restore website from wayback machine
Cara Memulihkan Website dari Wayback Machine: Panduan Lengkap
Pulihkan website dari Wayback Machine secara menyeluruh: pilih snapshot yang tepat, atur opsi pemulihan, lalu terapkan situs yang berfungsi dengan CMS dalam waktu kurang dari satu jam.

restore website
Cara Memulihkan Website: Semua Metode yang Benar-Benar Berhasil
Setiap cara efektif untuk memulihkan website: backup, snapshot hosting, Git, dan Wayback Machine, plus apa yang harus dilakukan jika tidak ada satupun yang tersedia.
