Klasy storage S3 - płać mniej za dane, których nie potrzebujesz codziennie

Nie wszystkie dane są traktowane równo. Zdjęcia profilowe użytkowników są pobierane setki razy dziennie. Logi sprzed 3 lat? Może raz w roku, na potrzeby audytu. Dlaczego płacić za obie kategorie tyle samo? AWS oferuje różne klasy storage w S3, każda zoptymalizowana pod inny wzorzec dostępu.

S3 Standard

Domyślna klasa. Dane dostępne natychmiast, wysoka trwałość i dostępność.

  • Trwałość: 99.999999999% (11 dziewiątek!) - AWS gwarantuje, że nie stracisz danych
  • Dostępność: 99.99% - dane są dostępne prawie zawsze
  • Dane replikowane w minimum 3 strefach dostępności (AZ)
  • Najwyższy koszt storage, ale zerowe koszty pobierania
  • Do: aktywne dane, strony www, aplikacje, content delivery
💡 Perspektywa
11 dziewiątek trwałości oznacza, że jeśli przechowujesz 10 milionów obiektów w S3, statystycznie możesz stracić jeden obiekt raz na 10 000 lat. To bardziej niezawodne niż cokolwiek, co zbudujesz samodzielnie.

S3 Intelligent-Tiering

Idealna klasa, gdy nie wiesz, jak często dane będą pobierane. S3 automatycznie przenosi obiekty między warstwami:

  • Frequent Access - jak S3 Standard (obiekty pobierane regularnie)
  • Infrequent Access - po 30 dniach bez dostępu (tańszy storage)
  • Archive Instant Access - po 90 dniach bez dostępu
  • Archive Access - opcjonalnie, po 90+ dniach
  • Deep Archive Access - opcjonalnie, po 180+ dniach

Koszt: niewielka opłata za monitoring (~$0.0025/1000 obiektów), ale zero opłat za przenoszenie między warstwami. Brak opłat za pobieranie!

S3 Standard-IA (Infrequent Access)

Tańszy storage niż Standard, ale opłata za każde pobranie.

  • Dane dostępne natychmiast (milisekundy)
  • Replikacja w 3+ AZ
  • Niższy koszt storage, wyższy koszt za GET request
  • Minimalna opłata za 128 KB i 30 dni
  • Do: backupy, disaster recovery, rzadko pobierane dane

S3 One Zone-IA

Jak Standard-IA, ale dane w jednej strefie dostępności. Jeszcze tańszy, ale ryzyko utraty danych przy awarii AZ.

  • 20% tańszy niż Standard-IA
  • Brak odporności na awarię strefy dostępności
  • Do: kopie danych, które możesz łatwo odtworzyć (np. thumbnails, transkodowane wideo)

S3 Glacier klasy

Klasy archiwalne - najniższy koszt storage, ale dostęp do danych zajmuje od minut do godzin:

Glacier Instant Retrieval
  • Dostęp w milisekundach (jak Standard)
  • Tańszy storage niż Standard-IA
  • Do danych pobieranych raz na kwartał
  • Min. 90 dni storage
Glacier Flexible Retrieval
  • Expedited: 1-5 minut
  • Standard: 3-5 godzin
  • Bulk: 5-12 godzin
  • Min. 90 dni storage

S3 Glacier Deep Archive

Najtańsza klasa storage w AWS. Dla danych, do których praktycznie nigdy nie sięgasz:

  • Standard retrieval: 12 godzin
  • Bulk retrieval: 48 godzin
  • Min. 180 dni storage
  • Koszt: ~$1/TB/miesiąc (vs ~$23/TB dla S3 Standard)
  • Do: compliance archives, dane regulacyjne przechowywane latami
📝 Na egzaminie
Na CLF-C02 musisz znać klasy S3 i wiedzieć, kiedy której użyć. Kluczowe: Standard = szybki i drogi. IA = tańszy storage, opłata za retrieval. Glacier = archiwa (minuty do godzin). Deep Archive = najtańszy, dostęp w godzinach/dniach. Intelligent-Tiering = automatyczny, gdy nie znasz wzorca. Przećwicz scenariusze w Akademii CloudManiak!

Lifecycle Rules - automatyzacja zarządzania danymi

Lifecycle Rules automatycznie przenoszą obiekty między klasami storage lub je usuwają. Definiujesz reguły, S3 wykonuje je automatycznie.

🏢 Scenariusz: Firma z wymogami compliance

Firma finansowa musi przechowywać dokumenty transakcji przez 7 lat. Lifecycle Rule:

  • Dzień 0-30: S3 Standard (aktywnie przeglądane)
  • Po 30 dniach: przenieś do Standard-IA (rzadko przeglądane)
  • Po 90 dniach: przenieś do Glacier Flexible Retrieval (archiwum)
  • Po 365 dniach: przenieś do Glacier Deep Archive (długoterminowe archiwum)
  • Po 2555 dniach (7 lat): automatyczne usunięcie

Zero ręcznej pracy. Koszty storage spadają automatycznie w miarę starzenia się danych.

S3 Replication

S3 może replikować obiekty między bucketami:

  • CRR (Cross-Region Replication) - replikacja do bucketa w innym regionie. Do disaster recovery i compliance
  • SRR (Same-Region Replication) - replikacja w tym samym regionie. Do agregacji logów, replikacji między kontami

Wymaga włączonego Versioningu na obu bucketach.

S3 Object Lock uniemożliwia usunięcie lub nadpisanie obiektów przez określony czas. Dwa tryby:

  • Governance mode - uprawnieni użytkownicy mogą ominąć blokadę
  • Compliance mode - NIKT (nawet root!) nie może usunąć obiektu do końca retention period

To jest WORM (Write Once Read Many). Wymagane przez regulacje finansowe i medyczne (SEC, HIPAA). Object Lock wymaga włączonego Versioningu.

🧠 Podsumowanie
  • S3 Standard - szybki, drogi, do aktywnych danych
  • S3 Intelligent-Tiering - automatyczne przenoszenie, gdy nie znasz wzorca
  • S3 Standard-IA - tańszy storage, opłata za retrieval, 3+ AZ
  • S3 One Zone-IA - jeszcze tańszy, ale tylko 1 AZ (ryzyko!)
  • Glacier Instant - milisekundy, dane raz na kwartał
  • Glacier Flexible - minuty do godzin
  • Glacier Deep Archive - najtańszy, godziny do dni
  • Lifecycle Rules automatycznie przenoszą dane między klasami
  • CRR/SRR = replikacja cross-region / same-region
🧪 Sprawdź się

Firma nie wie, jak często jej dane będą pobierane. Która klasa S3 automatycznie optymalizuje koszty?

A S3 Standard
B S3 Intelligent-Tiering
C S3 Glacier
S3 Intelligent-Tiering automatycznie przenosi obiekty między warstwami (Frequent, Infrequent, Archive) na podstawie wzorca dostępu. Idealne, gdy nie znasz wzorca z góry.

Firma musi przechowywać dane compliance przez 10 lat przy najniższym koszcie. Jaka klasa?

A S3 Standard-IA
B S3 Glacier Flexible Retrieval
C S3 Glacier Deep Archive
Glacier Deep Archive to najtańsza klasa S3 (~$1/TB/miesiąc). Idealna do danych compliance przechowywanych latami, do których praktycznie nigdy nie sięgasz. Retrieval trwa 12-48h, ale przy archiwach to akceptowalne.

Co robi Lifecycle Rule w S3?

A Automatycznie przenosi obiekty między klasami storage lub je usuwa
B Automatycznie szyfruje nowe obiekty
C Automatycznie replikuje obiekty do innego regionu
Lifecycle Rules definiują reguły automatycznego przenoszenia obiektów między klasami storage (np. Standard → IA → Glacier) lub ich usuwania po określonym czasie. Replikacja to osobna funkcja (CRR/SRR).