İnternet Sitelerinin Tarihi: Kaydedilen, Kaybolan ve Sebepleri
Restorix editör ekibi tarafından · 29 Mayıs 2026 · 7 dakika okuma

Web sitenizi Wayback Machine’den geri yükleyin
Saniyeler içinde ücretsiz tahmin — yalnızca onaylarsanız ödersiniz. Başarısız geri yüklemeler otomatik iade edilir.
Nisan 2009'da Yahoo, GeoCities'i kapatacağını duyurdu. Otuz sekiz milyon kullanıcı sayfası, MIDI dosyaları, animasyonlu inşaat tabelaları, X-Files'tan tropikal balıklara kadar her şeye adanmış hayran sayfaları, o Ekim ayında silinmek üzere planlandı. Archive Team adlı gönüllü bir ekip, bant genişlikleri elverdiği kadar altı ay boyunca indirme işlemi yaptı ve elde ettiklerini torrent olarak yayınladı. Erken web'in bir kısmı, yabancıların bunu koruması gerektiğine karar vermesi sayesinde hayatta kaldı. Erken web'in çoğu bu kadar şanslı değildi.
Bu, çevrimiçi geçen ilk on yıllardan gerçekten neyin korunduğuna, neyin kalıcı olarak yok olduğuna ve her ikisinin arkasındaki teknik ve sosyal nedenlere bir bakış. Belirli bir eski siteyi kurtarmaya çalışıyorsanız, son bölüme atlayın, o kısım sizin için.
İnternet sitelerinin tarihi, düşündüğünüzden daha yeni
Web, Ağustos 1991'de halka açıldı; Tim Berners-Lee CERN'den World Wide Web projesini duyurdu ve insanları info.cern.ch adresine yönlendirdi. Kimse arşivlemedi. Arşivleyecek bir şey yoktu, büyük ölçekli web tarayıcıları hâlâ yıllar uzaktaydı ve bilinçli olarak web sitelerini koruma fikri çoğu insanın gözünde biriktirmek olarak görülüyordu.
Internet Archive, Mayıs 1996'da Brewster Kahle tarafından kuruldu; crawl verileri Alexa Internet'ten aktı. Wayback Machine kendisi Ekim 2001'de halka açıldı ve zaten 10 milyar sayfa barındırıyordu. Bugün 900 milyardan fazla barındırıyor. Etkileyici, ama boşluk önemli. 1991'den 1996'ya kadar sistematik bir arşivleme yoktu. CERN, 2013'te ilk web sitesini orijinal adresinde restore ettiğinde, kimse bulabildi en eski kopya Kasım 1992'den dönüyordu. 1991 orijinali, web tarihinin tartışmasız en önemli sayfası, yalnızca ekran görüntülerinde ve yeniden yapılandırmalarda hayatta kalıyor.
Bu beş yıllık delikten kalan her şey tesadüfen hayatta: bir sysadmin'in yedek bandı, bir dergiyle birlikte verilen bir CD-ROM, silinmeyi unutmuş birinin FTP aynası.
Kim neyi kurtardı: arşivciler, gönüllüler ve kütüphaneler
Web sitenizi Wayback Machine’den geri yükleyin
Saniyeler içinde ücretsiz tahmin — yalnızca onaylarsanız ödersiniz. Başarısız geri yüklemeler otomatik iade edilir.
Dört grup kurtarma işini üstlendi, her birinin farklı motivasyonları ve farklı kapsama alanları var.
- Internet Archive sürekli tarama yapar ve halka açık Save Page Now gönderimlerini kabul eder. Web'in varsayılan hafızasıdır ve kontrol edilecek ilk yerdir.
- Archive Team, bir hizmet kapanacağını duyurduğunda harekete geçen gönüllü kurtarma kolektifidir. 2009'da GeoCities, 2019'da Google+ ve Yahoo Groups, ellerinden geleni kaparlar ve torrent olarak yayınlarlar.
- Ulusal kütüphaneler seçici olarak arşivler. UK Web Archive 2013'ten beri yasal depo kapsamında çalışıyor; Avustralya'nın PANDORA arşivi 1996'dan beri önemli Avustralya sitelerini derlemiştir.
- Common Crawl, 2008'den bu yana devasa açık tarama veri setleri yayınlıyor, araştırmacılar için paha biçilmez, ancak casus kullanıcıların gezinmesi için dostça bir takvim arayüzü yok.
Ayrı bir anı hak eden: 2012'den beri çalışan archive.today, talep üzerine anlık görüntüler alır ve genellikle Internet Archive'ın kaçırdığı sayfaları saklar; özellikle IA taramalarından engellenenleri.

İnternet sitelerinin tarihinin koruduğu şeyler: statik, herkese açık, popüler
Neyin en iyi korunduğuna bakın ve bir örüntü hemen ortaya çıkar. Arşivler, bir tarayıcının ucuza ve sıkça ulaşabildiği şeylere doğru önyargılıdır.
- Düz bağlantılar içeren statik HTML sayfaları, tarayıcının doğal yiyeceği.
- Özellikle dosya boyutları makul olduğunda, yakalanan bir sayfadan doğrudan bağlanan görseller ve dosyalar.
- Çok sayıda gelen bağlantıya sahip sayfalar, çünkü tarayıcılar bağlantıları takip eder ve popüler sayfalar sürekli yeniden taranırdı.
- Taranmaya izin veren robots.txt'ye sahip siteler, tek bir Disallow: / her şeyi gizlerdi.
- Her türden metin. Mükemmel şekilde sıkıştırılır ve hızlı geri döner.
Elle kodlanmış 1998 tarihli kişisel bir ana sayfa, mor arka plan, ziyaretçi sayacı, bağlantılar sayfası, GIF'ler dahil tamamen genellikle geri getirilebilir durumda. Kültürel ayak izi on kat daha büyük olan 2008 tarihli bir çevrimiçi mağaza genellikle aynı durumda değildir. Popülerlik ve sadelik her şeyi yener.
Kalıcı olarak yok olan şeyler ve nedenleri
Kayıplar birkaç öngörülebilir gruba yığılıyor ve en büyüğü düz bir metin dosyası. 2017'deki bir politika değişikliğine kadar Internet Archive, robots.txt dışlamalarını onurlandırıyor ve bunları geriye dönük olarak uyguluyordu, tek bir dosya düzenlemesi yıllarca mevcut yakalamaları halkın görüşünden gizleyebilirdi. Alan adları satılır, yeni sahibi kısıtlayıcı bir robots dosyası ekler ve on yıllık tarih bir gecede kararır. Sayısız site bu şekilde, veriler teknik olarak hâlâ mevcut olmasına rağmen arşivden yok oldu.
Giriş yapmanın arkasındaki her şey asla taranmadı: özel forumlar, erken sosyal ağlar, yalnızca üyelere açık topluluklar. Friendster'ın 2011 yeniden tasarımı, yıllarca süren profilleri tek bir deploy'da sildi. Dinamik, veritabanı odaklı sayfalar en iyi ihtimalle tutarsız taranıyordu, tarayıcılar GET linklerini işler, POST formlarını değil; bu yüzden arama sonuçları, alışveriş sepetleri ve filtrelenmiş listeler arşivlerin bildiği kadarıyla aslında hiç var olmadı.

Ağır medya da kötü durumda kaldı. RealPlayer döneminden streaming ses ve video, Java appletleri ve tuhaf protokoller üzerinden sunulan her şey atlandı veya bozuk yakalandı. Flash ünlü kenar durumudur:.swf dosyaları genellikle kaydedildi ama yıllarca oynatılamaz halde durdu; Ruffle emülatörü 2020'da birçoğunu tekrar çalıştırılabilir hale getirene kadar. Kimsenin yakalamadığı Flash parçaları ise tamamen gitti.
Rakamlar yakın web için bile kasvetli. Pew Research, 2024'te 2013'te var olan sayfaların yüzde 38'inin artık erişilebilir olmadığını buldu. Harvard'ın link çürümesi çalışması, ABD Yüksek Mahkemesi kararlarında alıntılanan URL'lerin yaklaşık yarısının zaten ölü olduğunu tespit etti. Koruma istisnadır. Çürüme varsayılandır.
Dinamik siteler arşivlemeyi neden bozdu
Bir tarayıcı URL'leri çeker. Bütün numara budur. 2005 tarihli bir phpBB forumu veya osCommerce mağazası bir URL koleksiyonu değildir, viewtopic.php?t=4821&start=40 gibi sorgu dizelerinden sayfa oluşturan bir veritabanıdır, URL'ler kılık değiştirmiştir. URL uzayı sonsuza yakındır, bu yüzden tarayıcılar örnekler. Dizin sayfalarını ve o ay iyi bağlantılı olan konuları yakalar, geri kalanını kaçırır.
Oturumlar ve çerezler işleri daha da kötüleştirir: aynı URL ziyaretçiye göre farklı içerik döndürür, bu yüzden bir yakalama oturum açmamış bir iskelet veya yönlendirme depolayabilir. Ve acı bir ekonomik açı var, metin almak ve depolamak ucuz, medya değil. Daraltılmış taramalar maliyetleri düşük tutmak için büyük dosyaları atladı; bu, neden bu kadar çok arşivlenmiş sayfanın görsellerin eskiden olduğu gri deliklerle metin olarak yüklendiğini açıklar.
Sonuç: arşivler genellikle bir sitenin iskeletini, ana sayfalar, statik makaleler, birkaç iyi bağlantılı konu, korur ama yaşayan organizmayı değil. Arama kutusu, üye listesi, ödeme akışı: bunlar hiçbir anlamlı düzeyde yakalanabilir değildi.
İnternet sitelerinin tarihini kendiniz nasıl keşfedersiniz
Belirli bir site için iş akışı kısadır:
- Alan adını web.archive.org'a girin. Takvim üzerindeki kıvılcım grafiği, yıla göre yakalama yoğunluğunu gösterir, yoğun yıllar kapsamlı bir kapsama anlamına gelir.
- Önce en eski yakalamayı açın, sonra ileriye doğru ilerleyin. Erken yakalamalar orijinal yapıyı ve eski URL kalıplarını ortaya çıkarır.
- Belirli bir URL'yi mi arıyorsunuz? CDX dizinini sorgulayın veya adresi doğrudan Wayback çubuğuna yapıştırın, bir sitenin sahip olduğu her sayfayı bulma rehberim API püf noktalarını kapsar.
- Internet Archive'ın kaçırdığı her şey için archive.today'ı çapraz kontrol edin.
- 1996 öncesi materyaller için resmi arşivler yerine operatör çalıştıran aynaları, üniversite derlemelerini ve nostalji projelerini arayın.
Büyük resimyi değil de tek bir sayfayı istiyorsanız, web sitesi geçmişi nasıl aranır ve web sitesi geçmişi araştırmasına dalma konusundaki kılavuzlarımız takvim, derlemeler ve alternatif arşivler hakkında ayrıntıları kapsar.
Geçmişe göz atmak yetmediğinde
Wayback Machine bir okuma odasıdır, bir geri yükleme düğmesi değil. İhtiyaç duyduğunuz gün gerçek siteyi geri istediğinizde, dosyaları, görselleri, kendi alan adınızda çalışan dahili bağlantıları, yaklaşık bir düzine sayfadan sonra manuel kaydetme çöker. Sağ tık, farklı kaydet, yolları düzelt, tekrar et: bölüm başına bir öğleden sonra ve sonuç parçalarla dolu bir klasördür.
Web sitesi geri yükleme servisi tam olarak bu iş için var. Alan adını yapıştırın ve ücretsiz tahmin, ödeme yapmadan önce tam arşivlenmiş dosya sayısını, toplam boyutu ve kilitli fiyatı gösterir. Dosya başına ödeme yaparsınız, ilk dosya ücretsizdir ve geri yüklemeler tarih aralığına göre filtrelenebilir ve temizlenebilir, eski analitikler ve reklamlar sıyrılır, bağlantılar göreli yapılır, HTTPS zorlanır. Yeniden oluşturulan site tek tıklamayla kendi barındırmanıza deploy edilir veya yapılandırılmış veri olarak dışa aktarılabilir. Öğretici tam akışı gösterir.
İnternet sitelerinin tarihi düzensizdir, ancak hayatta kalan şeyler genellikle iş için doğru aracı kullanırsanız kurtarılabilir durumdadır.
Web sitenizi Wayback Machine’den geri yükleyin
Saniyeler içinde ücretsiz tahmin — yalnızca onaylarsanız ödersiniz. Başarısız geri yüklemeler otomatik iade edilir.
FAQ
İnternet sitelerinin tarihi Wayback Machine'de ne kadar geriye gidiyor?
Yakalamalar 1996'da Internet Archive taramaya başladığında başlar. Web'in kendisi 1991'de başladı, bu yüzden ilk beş yıl yalnızca özel yedeklemelerde ve yeniden yapılandırmalarda mevcut, örneğin CERN'in restore ettiği ilk web sitesi, Kasım 1992 tarihli bir kopyadan geliyor.
Erken internetdeki her şey bir yerde arşivlenmiş mi?
Hayır. robots.txt tarafından engellenen sayfalar, girişlerin arkasındaki içerik, ağır medya ve dinamik olarak oluşturulan sayfalar nadiren yakalanmıştır. Wayback Machine veya archive.today bir sayfaya sahip değilse, büyük olasılıkla yalnızca özel ellerde, eğer varsa, hayatta kalır.
Site kesinlikle eskiyken neden eski bir sayfa 'arşivde yok' gösteriyor?
Genellikle dört nedenden biri: robots.txt tarayıcıları engelledi, sayfanın tarayıcıların takip edeceği gelen bağlantıları yoktu, dinamik olarak oluşturuldu veya alan adının yakalamaları sahiplik değişikliğinden sonra gizlendi. Yaş tek başına asla kapsama garantisi vermedi.
Tüm GeoCities sitelerine ne oldu?
Yahoo onları Ekim 2009'da sildi. Archive Team büyük bir dilimi kurtardı ve yaklaşık 900 GB'lık bir torrent olarak yayınladı; Reocities gibi aynaların parçaları hâlâ gezinilebilir durumda. Birçok GeoCities sayfası ayrıca Wayback Machine'de yaşıyor, ancak tam resmi bir yedekleme asla halka açık yapılmadı.
Bir site sahibi sitelerini web arşivlerinden silebilir mi?
Internet Archive, site sahiplerinden gelen kaldırma taleplerini onurlandırır ve robots.txt değişiklikleri tarihsel olarak 2017 politikası değişikliğine kadar yakalamaları geriye dönük olarak gizledi. Alan adı satışları bu şekilde arşivlere kamuya açık erişimi sildi. Ancak sunucunuzdan bir siteyi silmek, mevcut yakalamaları kendi başına kaldırmaz.
Web sitemi silmek onu Wayback Machine'den kaldırır mı?
Otomatik olarak hayır. Zaten alınmış yakalamalar, alan adı sahibi bir dışlama talebi dosyalamadıkça kullanılabilir durumda kalır. Arşivden bir şeyin gitmesini istiyorsanız, sormanız gerekir, siteyi çevrimdışı yapmak basitçe tarihi yerinde bırakır.
İlgili rehberler

website history
Web Sitesi Geçmişi: Anlık Görüntüler, WHOIS, DNS ve Her Biri İçin Araçlar
Web sitesi geçmişi arşivlenmiş anlık görüntüler, WHOIS kayıtları, DNS değişiklikleri veya eski sıralamalar anlamına gelebilir. Hangi aracın hangi soruyu yanıtladığını, ve kaybolan bir siteyi nasıl yeniden oluşturacağınızı öğrenin.

search website history
Alan Adı Satın Almadan Önce Web Sitesi Geçmişi Nasıl Araştırılır
Alan adı satın almadan önce web sitesi geçmişini araştırın: eski anlık görüntüler, sahiplik değişiklikleri, spam yükü ve marka tuzakları, 30 dakikalık bir due diligence iş akışı.

historical web
Tarihsel Web Bir Araştırma Kaynağı Olarak: Neler İşe Yarıyor
Akademisyenler, gazeteciler ve avukatların tarihsel web'i nasıl kullandığı: kayıtlar nerede saklanıyor, koruma kalitesi nasıl değerlendirilir ve bir yakalama ne zaman kanıt sayılır.

wayback machine
Wayback Machine: Web Geçmişini Taramanın Tam Rehberi
Wayback Machine 900 milyardan fazla web sayfasını arşivler. Taramaların, anlık görüntülerin, takvimin ve arama sözdiziminin nasıl çalıştığını ve kayıp bir siteyi nasıl geri yükleyeceğinizi öğrenin.
