Amazon S3 Glacier
Storage Cloud Practitioner Solutions Architect Associate

Amazon S3 Glacier

Amazon S3 Glacier

Najtańszy storage w AWS do długoterminowej archiwizacji danych. Trzy klasy Glacier z różnym czasem dostępu - od milisekund po 12 godzin - za ułamek ceny standardowego S3.

Amazon S3 Glacier to rodzina klas storage w Amazon S3 przeznaczona do długoterminowej archiwizacji danych rzadko odczytywanych. Oferuje najniższe koszty przechowywania w AWS - nawet $0.00099/GB-miesiąc dla Deep Archive (ok. $1 za TB miesięcznie).

Dostępne są trzy klasy Glacier: Glacier Instant Retrieval (dostęp w milisekundach), Glacier Flexible Retrieval (dawniej po prostu Glacier, dostęp w minutach/godzinach) i Glacier Deep Archive (najtańszy, dostęp w godzinach). Dane trafiają do Glacier przez lifecycle rules z S3 Standard lub przez bezpośredni upload. Vault Lock zapewnia zgodność z regulacjami WORM (Write Once Read Many).

Czy wiesz, ze...

Glacier Deep Archive kosztuje około $1 za terabajt miesięcznie. Oznacza to, że możesz przechowywać 1 PB (petabajt) danych za około $1000/mies. Dla porównania, ta sama ilość danych w S3 Standard kosztowałaby ponad $23 000/mies. - to 95% oszczędności.

Pro Tip

Skonfiguruj wielopoziomowy lifecycle: S3 Standard (0-30 dni) -> S3-IA (30-90 dni) -> Glacier Flexible (90-365 dni) -> Deep Archive (365+ dni). Dzięki temu dane automatycznie migrują do coraz tańszych klas w miarę starzenia się. Pamiętaj o minimalnych okresach przechowywania - usunięcie przed terminem wiąże się z opłatą.

Amazon S3 Glacier to rodzina klas storage do dlugoterminowej archiwizacji danych. Oferuje trzy tiery - Glacier Instant Retrieval, Glacier Flexible Retrieval i Glacier Deep Archive - rozniace sie czasem dostepu i cena. Dane sa przechowywane w vaultach lub jako obiekty S3 z odpowiednia klasa storage.

1

Wybor klasy archiwizacji

Glacier Instant Retrieval - dostep w milisekundach, idealny dla danych rzadko uzywanych (raz na kwartal), ok. 68% tanszy niz S3 Standard. Glacier Flexible Retrieval - pobieranie w minutach do godzin, dla archiwow z okazjonalnym dostepem. Glacier Deep Archive - najtanszy storage w AWS (ok. $1/TB/miesiac), pobieranie w 12-48 godzin, dla danych regulacyjnych i compliance.

2

Upload danych do archiwum

Dwa podejscia: (1) bezposredni upload do S3 z klasa storage GLACIER lub DEEP_ARCHIVE w naglowku x-amz-storage-class, (2) lifecycle policy na istniejacym buckecie S3, ktora automatycznie przenosi obiekty po X dniach. Dla duzych datasetow (>10 TB) uzyj S3 Transfer Acceleration lub AWS Snowball do initial load.

3

Lifecycle policies - automatyczna archiwizacja

Konfigurujesz reguly na buckecie S3: np. po 30 dniach przejdz do S3-IA, po 90 dniach do Glacier Flexible, po 365 dniach do Deep Archive. Reguly moga filtrowac po prefixie lub tagach. Tranzycje sa jednokierunkowe w dol (Standard -> IA -> Glacier -> Deep Archive). Mozna tez ustawic expiration - automatyczne kasowanie po X dniach.

4

Pobieranie danych (retrieval)

Glacier Instant Retrieval dziala jak standard S3 GET. Glacier Flexible oferuje trzy tryby: Expedited (1-5 min, najdrozszy), Standard (3-5 godzin), Bulk (5-12 godzin, najtanszy). Deep Archive: Standard (12 godzin) lub Bulk (48 godzin). Provisioned capacity gwarantuje dostepnosc Expedited retrievals. Po pobraniu obiekt jest dostepny przez skonfigurowany czas.

5

Vault Lock i compliance

S3 Glacier Vault Lock pozwala zdefiniowac polityki WORM (Write Once Read Many) - raz zablokowane nie moga byc zmienione nawet przez root account. Object Lock na S3 daje podobna funkcjonalnosc: Governance Mode (uprawienieni uzytkownicy moga usunac) i Compliance Mode (nikt nie moze usunac do uplywu retencji). Spelnaia wymagania SEC Rule 17a-4, HIPAA i FINRA.

6

Szyfrowanie i bezpieczenstwo archiwum

Wszystkie dane w Glacier sa domyslnie szyfrowane AES-256 (SSE-S3). Mozesz uzyc SSE-KMS dla wlasnych kluczy KMS z audytem dostepu w CloudTrail. Vault access policies i vault lock policies kontroluja kto moze czytac/zapisywac. S3 Object Lock w polaczeniu z bucket versioning zapewnia niezmiennosc danych.

Wskazowki do efektywnej archiwizacji - od doboru klasy storage po optymalizacje kosztow retrieval i zgodnosc z regulacjami.

Lacz lifecycle policies z Intelligent-Tiering

S3 Intelligent-Tiering automatycznie przenosi obiekty miedzy tierami na podstawie wzorcow dostepu, wlacznie z archiwalnymi tierami (Archive Access po 90 dni, Deep Archive Access po 180 dni). Dla nieprzewidywalnych wzorcow dostepu jest lepszy niz reczne lifecycle rules. Koszt monitoringu to $0.0025 za 1000 obiektow - oplacalny dla obiektow >128 KB.

Poczatkujacy

Uwazaj na koszty retrieval i minimum storage duration

Glacier Flexible ma minimum storage 90 dni, Deep Archive 180 dni - usuwasz wczesniej, platisz za caly minimalny okres. Koszty retrieval moga byc znaczace: Expedited to ok. $30/TB, Standard ok. $10/TB. Dla duzych przywrocen uzywaj Bulk (ok. $2.50/TB). Planuj disaster recovery z uwzglednieniem czasu i kosztu retrieval.

Zaawansowany

S3 Batch Operations do masowej archiwizacji

S3 Batch Operations pozwala jednym jobem zmienic klase storage milionow obiektow. Generujesz manifest (z S3 Inventory), definiujesz operacje (COPY z nowa storage class) i uruchamiasz. Idealne do jednorazowej migracji historycznych danych do Glacier. Job raportuje sukces/bledy dla kazdego obiektu.

Zaawansowany

Testuj procedury odzyskiwania regularnie

Archiwum, ktorego nie mozesz odzyskac, jest bezuzyteczne. Przynajmniej raz na kwartal przetestuj retrieval: czy dane sa kompletne, czy format jest czytelny, ile trwa odzyskanie. Dokumentuj procedure i czas odzyskania (RTO). Ustaw S3 Event Notification na RestoreCompleted, aby automatycznie powiadomic zespol o dostepnosci danych.

Poczatkujacy

Glacier Instant Retrieval zamiast S3 Standard-IA

Glacier Instant Retrieval jest ok. 30% tanszy niz Standard-IA przy takim samym czasie dostepu (milisekundy). Warunek: dane musza byc uzywane max raz na kwartal. Jezeli potrzebujesz czestszego dostepu - Standard-IA jest tanszy w przeliczeniu na retrieval. Porownaj calkowity koszt (storage + retrieval + requests) dla swojego wzorca dostepu.

Poczatkujacy

Screenshoty z AWS Console

Wkrotce pojawia sie tu zrzuty ekranu pokazujace jak korzystac z Amazon S3 Glacier bezposrednio w konsoli AWS.

Do czego sluzy Amazon S3 Glacier?

01

Backup i archiwizacja zgodna z regulacjami

Przechowywanie backupów baz danych, logów i dokumentów przez wymagany okres (np. 7 lat dla danych finansowych). Vault Lock gwarantuje niezmienność danych zgodnie z WORM.

02

Archiwum mediów i zasobów cyfrowych

Przechowywanie surowych nagrań wideo, zdjęć RAW i zasobów cyfrowych, które są rzadko odczytywane, ale muszą być dostępne na żądanie.

03

Disaster recovery i długoterminowa retencja

Przechowywanie kopii zapasowych systemów i danych DR w Deep Archive za minimalny koszt. W razie potrzeby odzyskanie w ciągu 12 godzin.

04

Dane naukowe i badawcze

Archiwizacja danych z eksperymentów, badań klinicznych i obserwacji naukowych. Dane mogą być przechowywane latami za symboliczny koszt i odczytywane przy nowych analizach.

Co musisz wiedziec?

Glacier Instant Retrieval

Klasa storage dla danych archiwizowanych, ale wymagających natychmiastowego dostępu (milisekundy). Do 68% taniej niż S3 Standard-IA. Idealna dla danych odczytywanych raz na kwartał.

Glacier Flexible Retrieval

Dawniej Amazon Glacier. Trzy opcje odczytu: Expedited (1-5 min), Standard (3-5 godz.), Bulk (5-12 godz.). Do 10x tańszy od S3 Standard. Minimum 90 dni przechowywania.

Glacier Deep Archive

Najtańsza klasa storage w AWS. Czas odczytu: Standard (12 godz.), Bulk (48 godz.). Cena od $0.00099/GB-mies. Minimum 180 dni przechowywania. Dla danych odczytywanych raz/dwa razy w roku.

Vault Lock

Polityka WORM (Write Once Read Many) blokująca vault przed modyfikacją i usunięciem. Po aktywacji jest nieodwracalna - nawet konto root nie może jej zmienić. Wymagana dla compliance (SEC, FINRA, HIPAA).

Retrieval Policy

Polityka kontrolująca koszty odczytu danych z Glacier. Free Tier - darmowy odczyt do 10 GB/mies. Max Retrieval Rate - limit przepustowości odczytu. No Limit - bez ograniczeń (uwaga na koszty).

Lifecycle Rules

Reguły automatycznego przenoszenia obiektów między klasami S3. Np. po 30 dniach z S3 Standard do S3-IA, po 90 dniach do Glacier Flexible, po 365 dniach do Deep Archive.

Architektura: System archiwizacji i compliance z S3 Glacier

Architektura automatycznej archiwizacji danych z wielopoziomowym lifecycle management. Dane przechodzac przez kolejne tiery storage az do dlugoterminowego archiwum z pelnym audytem i ochrona WORM.

Aplikacja / Systemy Generuja dane operacyjne, logi, dokumenty
Upload
Amazon S3 (Standard)
Amazon S3 (Standard) Aktywne dane z natychmiastowym dostepem, bucket versioning
Transition rules
S3 Lifecycle Policy
S3 Lifecycle Policy Automatyczne przejscia: Standard -> IA -> Glacier -> Deep Archive
Archive (180+ dni)
S3 Glacier Deep Archive
S3 Glacier Deep Archive Dlugoterminowe archiwum z Vault Lock WORM, ~$1/TB/mies.
Audit log
AWS CloudTrail
AWS CloudTrail Audyt kazdego dostepu do archiwum dla compliance
Ustaw S3 Object Lock w trybie Compliance na buckecie archiwum - nawet administrator root nie moze usunac danych przed uplywem retention period.
S3 Inventory generuje cotygodniowy raport wszystkich obiektow z ich klasa storage - uzywaj go do audytu i planowania kosztow archiwizacji.
Dla regionow z wymaganiami data residency uzyj S3 replication z filtrem na klasy Glacier do dedykowanego regionu compliance.

Ile kosztuje Amazon S3 Glacier?

Glacier Instant Retrieval

Tani storage z natychmiastowym dostępem. Opłata za przechowywanie, odczyt i minimum 90 dni retencji.

$0.004/GB-mies. storage + $0.03/1000 żądań GET

Glacier Flexible Retrieval

Bardzo tani storage z elastycznym czasem dostępu. Opłata za przechowywanie, odczyt i typ retrieval.

$0.0036/GB-mies. storage, Expedited: $0.03/GB, Standard: $0.01/GB

Glacier Deep Archive

Najtańszy storage w AWS. Minimalny koszt przechowywania, wyższy koszt i czas odczytu.

$0.00099/GB-mies. (~$1/TB-mies.), Standard retrieval: $0.02/GB

Opłaty za wczesne usunięcie

Usunięcie obiektu przed upływem minimalnego okresu przechowywania wiąże się z opłatą za pozostałe dni.

Flexible: min. 90 dni, Deep Archive: min. 180 dni

Przyklady AWS CLI

Upload bezpośrednio do Glacier

Przesyła plik bezpośrednio do klasy Glacier Flexible Retrieval

aws s3 cp backup-2024.tar.gz \
  s3://my-archive-bucket/backups/ \
 --storage-class GLACIER

Ustaw lifecycle rule

Konfiguruje automatyczne przenoszenie obiektów do Glacier i Deep Archive

aws s3api put-bucket-lifecycle-configuration \
 --bucket my-bucket \
 --lifecycle-configuration file://lifecycle.json

# lifecycle.json:
# {"Rules":[{"ID":"archive","Status":"Enabled","Filter":{"Prefix":"logs/"},
#   "Transitions":[{"Days":90,"StorageClass":"GLACIER"},
#   {"Days":365,"StorageClass":"DEEP_ARCHIVE"}]}]}

Przywróć obiekt z Glacier

Inicjuje odczyt obiektu z Glacier Flexible Retrieval w trybie Standard

aws s3api restore-object \
 --bucket my-archive-bucket \
 --key backups/backup-2024.tar.gz \
 --restore-request Days=7,GlacierJobParameters={Tier=Standard}

Sprawdź status przywracania

Sprawdza czy obiekt z Glacier jest już dostępny do pobrania

aws s3api head-object \
 --bucket my-archive-bucket \
 --key backups/backup-2024.tar.gz \
 --query "Restore"

Quiz: Amazon S3 Glacier

Sprawdz czy dobrze rozumiesz podstawy. Kliknij odpowiedz — feedback pojawi sie od razu.

Twoj wynik: 0 / 4

1. Która klasa Glacier oferuje najniższy koszt przechowywania?

2. Jaki jest najszybszy sposób odczytu danych z Glacier Flexible Retrieval?

3. Do czego służy Vault Lock?

4. Jak dane najczęściej trafiają do klas Glacier?

Chcesz poznac Amazon S3 Glacier w praktyce?

Darmowy kurs "AWS od podstaw" pokazuje jak uzywac Amazon S3 Glacier krok po kroku. Teoria + praktyka od zera.

Zacznij darmowy kurs Wszystkie serwisy