Wróć do roku 2000 – poznaj niezwykłe sekrety Wayback Machine

Udostępnij ten wpis:
Czy wiedzieliście, że możecie zobaczyć, jak wyglądała Wasza ulubiona strona internetowa kilkanaście lat temu? 🌐
 

Tak! To możliwe dzięki fundacji non-profit Internet Archive, która stworzyła system Wayback Machine już w 1996 roku.

 
Można tam przejrzeć archiwalne wersje niemal większości serwisów internetowych. Nowsze witryny, które stosują zaawansowane blokady przed botami, nie zawsze są tam dostępne, ponieważ robotom indeksującym nie udało się ich zeskanować. Jednak tysiące miliony portali pozwala Wayback Machine na automatyczne tworzenie cyfrowych kopii w celu upamiętnienia ich w historii internetu.
 
Znajdziecie tam prawie wszystkie strony WWW na świecie! Wpiszcie sobie youtube.com lub google.com i zobaczcie początki rozwoju sieci. To niesamowite uczucie – przeklikać się 20 lat wstecz, zobaczyć, jak bardzo zmieniła się technologia i jak ogromny krok zrobiliśmy do przodu.🚀
 

⏱️ Jak to zrobić krok po kroku?

1. Wejdź na stronę https://web.archive.org/.
2. Wyszukaj witrynę, której historię chcesz sprawdzić.
3. Najstarszą wersję znajdziesz, sprawdzając, czy na osi czasu wyświetla się wykres.
4. Kliknij rok, w którym widać pionowe słupki, a następnie wybierz z kalendarza poniżej dowolny dzień zaznaczony niebieskim kółkiem.
 
💡 Wskazówka: Czasami po kliknięciu niebieskiego kółka może wyświetlić się błąd 302. W takiej sytuacji po prostu cofnij się i spróbuj wybrać inny dzień z kalendarza.
 
Ciesz się powrotem do przeszłości! Poniżej możecie zobaczyć, jak wyglądał serwis tvn.pl 27 października 2000 roku. 👇

🏗️ Co kryje się za kulisami Wayback Machine?

 
Skala tego projektu jest trudna do wyobrażenia:
– Ogromne zasoby: archiwum zajmuje obecnie od 100 do 175 petabajtów (PB) danych, co odpowiada ponad 1 bilionowi zarchiwizowanych stron internetowych. Baza rośnie w tempie około 150 terabajtów dziennie!
 
– Własna infrastruktura: dane są przechowywane we własnych centrach danych (Data Centers) Internet Archive. Główna infrastruktura znajduje się w Kalifornii (USA), a ze względów bezpieczeństwa kopie zapasowe trafiają też do innych krajów.
 
– Tysiące serwerów: fundacja posiada od 15 000 do 20 000 serwerów oraz dziesiątki tysięcy dysków twardych, które są nieustannie rozbudowywane.
 

💰 Kto za to płaci i jak powstaje ten sprzęt?

Roczny budżet organizacji wynosi około 25–37 milionów dolarów. To z tych środków opłacany jest potężny prąd oraz klimatyzacja hal serwerowych. Żeby oszczędzać, Internet Archive zatrudnia własnych inżynierów i nie kupuje drogich, gotowych serwerów od gigantów takich jak Dell czy HPE. Sami projektują szafy serwerowe, zamawiając surowe obudowy od Supermicro i masowo dokupując zwykłe dyski twarde. Dzięki temu koszt przechowywania danych jest kilkukrotnie niższy niż w komercyjnych chmurach pokroju AWS.
 
Ponieważ Internet Archive to fundacja pożytku publicznego, nie zarabia na reklamach czy abonamentach. Wszystkie rachunki opłacane są z trzech źródeł:
 
1. Wielcy filantropi: poważne sumy wpłacają fundacje (np. Andrew W. Mellon Foundation) oraz założyciel projektu, Brewster Kahle, który pod koniec lat 90. zarobił fortunę na sprzedaży swojej firmy Amazonowi.
 
2. Zbiórki od użytkowników: podobnie jak Wikipedia, Internet Archive prosi internautów o drobne wpłaty. Średnia darowizna wynosi około 14 dolarów, ale miliony małych wpłat sumują się w wielkie kwoty.
 

3. Usługa komercyjna „Archive-It”: organizacja umożliwia uniwersytetom, bibliotekom państwowym i rządom zamawianie prywatnych, dedykowanych archiwizacji ich własnych systemów. Te instytucje płacą za to roczny abonament, dając fundacji stabilny dochód.