Wayback Machine: Ang Kumpletong Gabay sa Pag-browse sa Kasaysayan ng Web
Ni ang koponan sa editoryal ng Restorix · Abril 30, 2026 · 9 min na pagbabasa

Ibalik ang iyong website mula sa Wayback Machine
Libreng estimate sa ilang segundo — magbabayad ka lang kapag kinumpirma. Awtomatikong na-re-refund ang mga nabigong restore.
Napakarami nang beses na nailigtas ako ng Wayback Machine. WooCommerce store ng kliyente na nabura dahil sa masamang plugin update. Pricing page ng kakompetensya mula 2019, kailangan para sa usapang kontrata. Ang orihinal na bersyon ng artikulo na tahimik na pinalitan ng may-akda matapos ma-quote sa demanda. Ito ang memorya ng web, at libre itong gamitin. Pero karamihan sa mga tao, ang alam lang ay ang search box sa homepage at nalilimutan ang lahat ng iba pa. Saklaw ng gabay na ito kung paano talaga gumagana ang archive, bawat search trick na dapat malaman, saan ito kulang, at ano ang gagawin kapag hindi na sapat ang pag-browse sa mga snapshot at kailangan mo na talaga ibalik ang mismong site.
Ano ang Wayback Machine sa Totoong Lang
Ang Wayback Machine ay isang libreng pampublikong archive ng mga web page, pinapatakbo ng Internet Archive, isang nonprofit na digital library na nakabase sa San Francisco. Itinatag ni Brewster Kahle ang organisasyon noong 1996, at nabuksan sa publiko ang Wayback Machine noong 2001. Ang pangalan ay paggunita sa WABAC machine, ang time-travel gadget mula sa cartoon noong 1960 na Peabody's Improbable History, kaya naman marami ang nalilito at tinatawag itong 'the way back machine'.
Umabot na sa mahigit 900 bilyong naka-archive na web page ang koleksyon at patuloy itong lumalago nang higit sa isang bilyong page kada linggo. Kasama ng mga web page, nag-iimbak din ang Internet Archive ng mga na-scan na libro, TV news, audio, at lumang software na maaaring patakbuhin sa browser. Libre ang pag-browse at hindi kailangan ng account.
Isang mahalagang pagkakaiba ang dapat malinaw muna: ang ini-archive ng Wayback Machine ay mga page, hindi site. Bawat snapshot ay isang URL na nakuhanan sa isang sandali. Walang 'buong site, March 2015' na nakadokumento, libu-libong indibidwal na page capture lang ang may iisang domain. Tandaan ito, dahil halos lahat ng kakaibang mararanasan mo sa hinaharap ay dahil dito.
Paano Gumagana ang mga Crawl at Snapshot
Ibalik ang iyong website mula sa Wayback Machine
Libreng estimate sa ilang segundo — magbabayad ka lang kapag kinumpirma. Awtomatikong na-re-refund ang mga nabigong restore.
Ang archive ay gawa sa mga crawler. Sa mga unang taon, umasa ang Internet Archive sa crawl data mula sa Alexa Internet, isang web-analytics company na co-founded ni Kahle; ngayon, may sarili na silang crawling operation, kasama ng mga partner crawl at milyon-milyong manual save mula sa mga user. Humihiling ang crawler ng URL, iniimbak ang HTML na natanggap, saka kukunin ang mga asset na tinutukoy ng HTML, mga larawan, stylesheet, script, bawat isa ay naka-imbak bilang sarili nitong file.
Ang detalyeng ito ang dahilan ng pinakakaraniwang kalituhan. Ang snapshot ay hindi isang folder na nakatali sa panahon. Ang HTML ng page ay maaaring mula sa Marso 3, ang stylesheet naman ay mula Marso 9, at ang pangunahing larawan ay mula Pebrero 20. Kapag tumugma ang lahat, maayos ang pag-render ng page. Kapag hindi, makikita mo ang klasikong sira na snapshot: buo ang teksto, gulo ang layout, kulay abong kahon ang dapat ay mga larawan.
Gaano kadalas nafi-crawl ang isang page
Walang iskedyul na maaasahan. Nakadepende ang dalas ng crawl sa kasikatan: ang homepage ng pangunahing pahayagan ay maaaring ma-capture ng libu-libong beses sa isang araw, samantalang ang 2009 phpBB forum ay maaaring lumabas lang ng dalawang beses sa isang dekada. Kung mahalaga sa iyo ang isang page, huwag maghintay na mapansin ito ng crawler, i-save mo na sarili mo, isang trick na tatalakayin sa mga susunod na seksyon.
Ano ang maaaring humarang sa crawl
Sinusunod ng crawler ang robots.txt, at maaaring mailapat retroactively ang isang exclusion: ang site na maglalagay ng blanket disallow sa domain nito ay maaaring mawala ang buong capture history nito hanggang sa matanggal ang harang. Maaari ding hilingin ng mga may-ari ng site sa Internet Archive na i-exclude ang kanilang content. Ang mga page na nasa likod ng login at paywall ay hindi kailanman nafi-crawl.
Pagbasa sa Kalendaryo at Timeline
Maghanap ng URL at mapupunta ka sa calendar view. Dalawang instrumento ang gumagana. Ang bar graph sa ibabaw ay nagpapakita ng bilang ng capture bawat taon, mabilis na paraan upang makita kung kailan aktibo ang site, kailan abala, at kailan ito tumigil. Ang kalendaryo sa ibaba ay minamarkahan ang bawat araw na may capture sa piniling taon.
- Asul na bilog: normal na capture na nagbalik ng 200 OK.
- Berde na bilog: ang capture ay isang redirect. Sinundan ito ng crawler, kaya tingnan kung saan ito napunta.
- Pulang marka: error response, karaniwan ay 404 o 500. Bihirang sulit buksan.
- Mas malaking bilog: mas maraming capture sa araw na iyon. I-hover ang araw para sa eksaktong oras, i-click ang timestamp upang buksan.
Magbukas ng snapshot at may banner sa itaas ng page. May dalang eksaktong UTC timestamp, mga arrow para sa nakaraang at susunod na capture, at 'About this capture' panel na may crawl metadata. Kapag naghahanap ka ng partikular na pagbabago, halimbawa, kailan inalis ng isang kompanya ang refund clause nito, huwag mag-click ng random na araw. Maghanap ng cluster at gaps, saka i-bracket ang pagbabago sa pagitan ng huling capture na mayroon nito at ng una na wala na.

Search Syntax ng Wayback Machine na Dapat Tandaan
Ang search box sa homepage ang pinakamabagal na paraan. Ang URL mismo ang tunay na interface, at iilang pattern lang ang sasaklaw sa halos lahat ng kailangan mo.
| Pattern | Ano ang ginagawa nito | Halimbawa |
|---|---|---|
| web.archive.org/web/2020/URL | Pinakamalapit na capture sa Enero 1, 2020 | web.archive.org/web/2020/example.com |
| web.archive.org/web/20200615143000/URL | Pinakamalapit na capture sa eksaktong segundo (UTC, YYYYMMDDhhmmss) | web.archive.org/web/20200615143000/example.com |
| web.archive.org/web/*/URL | Kalendaryo ng bawat capture ng partikular na page | web.archive.org/web/*/example.com/pricing |
| web.archive.org/web/*/domain/* | Bawat naka-capture na URL sa ilalim ng domain, puwedeng i-filter | web.archive.org/web/*/example.com/* |
| web.archive.org/web/2020id_/URL | Orihinal na file, walang banner, walang pinalitang link | web.archive.org/web/2020id_/example.com |
| web.archive.org/web/2020im_/URL | Image asset lang sa timestamp na iyon | web.archive.org/web/2020im_/example.com/logo.png |
Dalawa sa mga ito ang dapat bigyang-diin. Ang domain-wide URL list ang pinakamabilis na paraan upang mahanap ang page na hindi mo lubos na matandaan ang address, mag-type ng tipak ng slug sa filter box at pipiliin ng archive ang libu-libong path para maibaba sa iisang post na kailangan mo. At ang id_ modifier ang ginagamit ng mga propesyonal kapag kailangan nila ang mismong file at hindi re-framed preview, dahil inihahatid nito ang orihinal na bytes nang walang banner at walang sinasawang link.
Save Page Now at Kailan Ito Tumatanggi
Hindi lang reading room ang archive. Ang Save Page Now ang nag-su-save dito: i-paste ang anumang pampublikong URL sa web.archive.org/save at kukunin ng crawler ang live page sa loob ng ilang segundo. Ang libreng account ay nag-u-unlock ng mga extra tulad ng pag-save ng mga outlinked page at full-page screenshot. Kung naglalathala ka ng anumang mahalaga, ang pag-save nito sa parehong araw ang pinakamura ng insurance sa internet.
Mas madalas itong tumatanggi kaysa inaasahan. Ang mga page na naka-block ng robots.txt ay hindi ma-i-save. Ang anonymous use ay may rate limit, kaya ang batch-saving ng limampung page nang sunod-sunod ay maaantala. Ang login screen ay na-i-save bilang login screen. At ang mabibigat na JavaScript app ay minsan ay na-aarchive bilang empty shell, ang HTML ay na-save nang maayos, pero ang content ay umiiral lang pagkatapos tumakbo ang mga script, at ang mga script ay nagtanong sa API na matagal nang patay.
Saan Kulang ang Wayback Machine
- Ang anumang nasa likod ng login, paywall, o POST form ay hindi kailanman naka-archive.
- Ang mga interactive app na na-render gamit ang JavaScript ay madalas na naka-survive bilang empty shell.
- Ang streaming video at audio ay bihirang tumatakbo mula sa lumang capture.
- Mga gap. Ang isang linggo na desperate mong kailangan ay talagang ang linggo na walang nag-crawl.
- Walang buong-site download. Nag-browse ka ng isang page sa isang pagkakataon, na may mga link na na-rewrite upang tumuro pabalik sa archive.
- Ang server-side code ay nawala na habambuhay. Ang mga snapshot ay naglalaman ng rendered HTML; ang PHP, ang database, at ang admin panel ay hindi kailanman naging pampubliko, kaya hindi rin naka-archive.
Wala sa mga ito ang bug. Ang archive ay ginawa para sa memorya, hindi para sa migration, at ang pagkakaibang ito ang mahalaga sa sandaling ang layunin mo ay lumipat mula sa pag-basa ng lumang page patungo sa muling pagbuo ng buong website.
Mula sa Wayback Machine Patungo sa Naibalik na Site
Ang pag-browse sa snapshot ay sumasagot ng mga tanong. Hindi ka nito bibigyan ng website. Ang mga link ay tumuturo pabalik sa archive.org, ang mga asset ay inihahatid mula sa mga server ng archive, at walang export button. Ang mano-manong pag-copy ay gumagana para sa isa o dalawang page; ang 3,000-page na store na makopya sa ganitong paraan ay isang buwan ng buhay mo na hindi mo na babalikan. Ito ang sandaling kung saan ang mga tao ay tumitigil mag-research at nagsisimulang maghanap ng Wayback Machine restore sa halip.
Ang gap na iyon ang eksaktong dahilan kung bakit ginawa ang Restorix CMS. Kinukuha nito ang bawat naka-archive na file ng isang domain, muling binubuo ang gumaganang internal links, at nagpapakita muna ng libreng estimate, ang eksaktong bilang ng file, kabuuang sukat, at naka-lock na presyo bago ka magbayad ng kahit ano. Ang mga restore ay binabayaran kada file, ang unang file ay libre, at ang mga nabigong restore ay awtomatikong nire-refund sa balance mo. Ang mga opsyon ay sumasaklaw sa mga hindi glamorous pero mahalagang bahagi: pagtanggal ng lumang analytics at ad script, pag-convert ng mga link sa relative, pagpuwersa sa HTTPS, pag-iingat sa 301 redirects, at pag-export ng structured article data bilang XML, CSV, o JSON.

Kapag handa na ang mga file, iisang click lang ang magde-deploy sa kanila sa sarili mong VPS sa SSH o SFTP, sa shared hosting sa FTP, o sa S3 bucket, at kasama sa bawat deploy ang isang maliit na single-file CMS sa /webarchive-cms.php, kaya ang naibalik na site ay maa-edit na sa sandaling ito ay dumating. Ang tutorial ay naglalakad sa iyo sa buong proseso sa loob ng halos sampung minuto.
Ibalik ang iyong website mula sa Wayback Machine
Libreng estimate sa ilang segundo — magbabayad ka lang kapag kinumpirma. Awtomatikong na-re-refund ang mga nabigong restore.
FAQ
Legal ba gamitin ang Wayback Machine?
Legal ang pag-browse, at ang archive ay gumagana bilang library. Ang copyright ay may pa ring epekto sa gagawin mo sa content, ang pagbasa ng lumang page ay ayos lang, ang pagre-publish ng text ng ibang tao nang buo ay hindi. Ang pagbalik ng sarili mong site, o content na hawak mo ang karapatan, ang karaniwan at ligtas na kaso.
Gaano na ka-layo ang abot ng Wayback Machine?
Nagsimula ang crawl data noong 1996, kaya ang pinakamatandang capture ay halos tatlong dekada na. Ang coverage mula 1990s ay manipis; nagiging siksikan ang mga bagay mula mid-2000s pataas.
Bakit kulang ang larawan o styling ng isang snapshot?
Bawat asset ay kinukuha nang hiwalay, at ang ilan ay hindi kailanman nakuha, naka-block ng robots.txt, inihatid mula sa ibang domain, o simpleng na-miss sa araw na iyon. Ang HTML ay nakaligtas; ang pintura ay hindi. Subukan ang capture na ilang araw na mas maaga o mas huli.
Maaari ko bang i-download ang buong website mula sa Wayback Machine?
Walang site-download button ang archive mismo. Maaari kang mag-save ng page nang paisa-isa, o gumamit ng restore service tulad ng Restorix na muling binubuo ang buong domain, ang aming gabay sa [pag-download ng buong website mula sa archive.org](/fil/download-entire-website-from-archive-org) ay naglalakad sa bawat opsyon.
Paano ko tatanggalin ang sarili kong site mula sa Wayback Machine?
Magdagdag ng disallow para sa ia_archiver crawler sa robots.txt, o magpadala ng exclusion request sa Internet Archive. Ang mga block ay maaaring magtago ng mga nakaraang capture din, hindi lang ang mga paparating.
Nini-archive ba ng Wayback Machine ang social media?
Bahagya. Ang mga pampublikong post at profile ay nakukuha, pero ang mga feed na gawa sa login at infinite scroll ay hindi maganda na-aarchive. Ituring ang mga social capture bilang swerte, hindi maaasahang talaan.
Mga kaugnay na gabay

wayback
Paano Gamitin ang Wayback Araw-Araw: Mga Nawawalang Pahina, Patay na Link, Lumang Mga Pahayag
Ang Wayback ang pinakamabilis na paraan upang maibalik ang isang nawawalang pahina, tingnan kung ano ang sinabi ng isang site noong nakaraang taon, mag-cite ng patay na link, o suriin ang isang kumpanya bago ka magbayad. Narito kung paano.

the way back machine
The Way Back Machine: Ano Ito at Bakit Ito Umiiral
Naghahanap ng 'the Way Back Machine'? Natagpuan mo ito, opisyal na ang Wayback Machine. Narito kung ano ito, sino ang gumawa nito, at kung ano ang kaya at hindi nito magagawa.

wayback machine restore
Pag-restore sa Wayback Machine: 4 Pitfalls at Paano Maiiwasan ang mga Ito
Ang pag-restore sa Wayback Machine ay maaaring mabigo nang tahimik: mga parked page, redirect chain, nawawalang larawan, magkahalong timestamp. Paano matukoy ang bawat pitfall at maiwasan ito.

download entire website from archive org
I-download ang Buong Website mula sa Archive.org, Hindi Lang ang Homepage
Para ma-download ang buong website mula sa archive.org, kailangan mo ng bawat pahina, imahe, at stylesheet. Ang mga asset ay nakatago sa iba't ibang timestamp, narito ang dahilan, kasama ang kumpletong checklist.
