AWS S3のGlacier系のエクスポートに時間がかかるのはなぜ? 裏ではどういう仕組みで動いているんですか? ほかはキャッシュ化されていたり、保管方法に違いがあるの? 書き込みも遅いの? |
|
|
かなり本質的なところですね。 まず前提として、S3 Standardのような普通のオブジェクトストレージは、
という「即アクセス前提」の設計です。 一方、Glacier系は思想が違います。 なぜ遅いのかGlacier系は、 そのため、
という方向に最適化されています。 つまり、 裏では何が起きているのかユーザーがGlacierのデータを取得するとき、 これは内部的には、
みたいなことをしています。 つまり、 だから数分〜数時間かかる場合があります。 本当にテープなの?昔のアーカイブは磁気テープ文化が強かったので、 実際の内部実装は公開されていませんが、 つまり:
です。 キャッシュ化されているの?はい、ある程度されています。 例えば:
などは高速層に残っている可能性があります。 ただしS3 Standardほど「常時ホット」ではありません。 Glacier Instant Retrieval は、 逆に Deep Archive は、 書き込みも遅いの?実は、 理由は、
などへ入れて、 つまりユーザーから見ると、 ただし内部ではその後、
なぜそんなに安くできるのか本質は:
です。 つまり、 イメージでいうとS3 Standard: Glacier: Deep Archive: みたいな感じです。 だから、 |
| |

この記事へのコメント