AWS S3のGlacier系のエクスポートに時間がかかるのはなぜ?

c-dustin-K-Iog-Bqf8E-unsplash.jpg

質問

AWS S3のGlacier系のエクスポートに時間がかかるのはなぜ?
裏ではどういう仕組みで動いているんですか?
ほかはキャッシュ化されていたり、保管方法に違いがあるの?
書き込みも遅いの?


AWS音声活用術!Amazon Connect実践入門 【電子書籍】[ Bladean Mericle ]

価格:1980円
(2026/5/18 19:35時点)
感想(0件)

AWSエンジニア入門講座ーー学習ロードマップで体系的に学ぶ 【電子書籍】[ CloudTechロードマップ作成委員会【著】 ]

価格:2838円
(2026/5/18 19:36時点)
感想(0件)


解答

かなり本質的なところですね。
Glacier系が遅い理由は、単に「性能を制限している」だけではなく、**“安く保存するために、すぐ読めない構造にしている”**からです。

まず前提として、S3 Standardのような普通のオブジェクトストレージは、

  • 常時オンライン

  • 高速ストレージ上に配置

  • すぐ取り出せる状態

  • インデックスも即参照可能

という「即アクセス前提」の設計です。

一方、Glacier系は思想が違います。


なぜ遅いのか

Glacier系は、
「めったに読まないデータを超低コストで保管したい」
ための仕組みです。

そのため、

  • 低コストな保存媒体

  • 密度重視

  • 電力消費を抑える

  • 常時アクセス前提ではない

  • 即時参照用キャッシュを薄くする

という方向に最適化されています。

つまり、
“すぐ読める状態を維持しない”ことで安くしている
わけです。


裏では何が起きているのか

ユーザーがGlacierのデータを取得するとき、
実際には「復元(Restore)」という処理が走ります。

これは内部的には、

  1. アーカイブ保管領域から対象データを探す

  2. 分散保存されたチャンクを集める

  3. 復元用の高速領域へ展開

  4. 一時的にS3的な即アクセス領域へ置く

みたいなことをしています。

つまり、
直接その場で読むのではなく、“取り出し準備”をしている
んです。

だから数分〜数時間かかる場合があります。


本当にテープなの?

昔のアーカイブは磁気テープ文化が強かったので、
Glacierも「テープみたいなもの」とよく言われます。

実際の内部実装は公開されていませんが、
思想としてはかなり近いです。

つまり:

  • 容量効率最優先

  • 即時アクセス不要

  • 順次アクセス寄り

  • 省電力

  • 超大規模分散

です。


キャッシュ化されているの?

はい、ある程度されています。

例えば:

  • 最近アクセスされたもの

  • 復元要求が多いもの

  • 小さいメタデータ

などは高速層に残っている可能性があります。

ただしS3 Standardほど「常時ホット」ではありません。

Glacier Instant Retrieval は、
この「キャッシュ・高速層寄り」をかなり強化したタイプです。

逆に Deep Archive は、
「本当に滅多に読まない」前提なので極端に安い代わりに遅いです。


書き込みも遅いの?

実は、
読み出しほどは遅くありません。

理由は、
クラウドストレージでは書き込み時にまず:

  • 受信バッファ

  • 分散キュー

  • 一時ストレージ

などへ入れて、
バックエンドへの配置を非同期化できるからです。

つまりユーザーから見ると、
「保存完了」が比較的早く返せる。

ただし内部ではその後、

  • 冗長化

  • 圧縮

  • 分散配置

  • アーカイブ最適化
    などが進んでいます。


なぜそんなに安くできるのか

本質は:

  • 即時アクセス性を捨てる

  • 高価な高速ストレージを減らす

  • 電力を抑える

  • 密度重視

  • “読む前提”を弱める

です。

つまり、
「SSDのような便利さ」を犠牲にしている
から安い。


イメージでいうと

S3 Standard:
「常に机の上に置いてある資料」

Glacier:
「巨大倉庫の棚に保管してある箱」

Deep Archive:
「地下倉庫の奥に封印してある箱」

みたいな感じです。

だから、
“読む”ではなく、
“取り寄せる”
という感覚の方が近いです。






 



この記事へのコメント