ある企業は、Amazon S3 に 10~15 TB の非圧縮 .csv ファイルを保存しており、Amazon Athena を使用して一度限りの評価を実行する予定です。この企業は、クエリ時間を短縮し、ストレージコストを削減するためにデータを変換したいと考えています。Athena クエリのこれらの要件を最も満たすファイル形式と圧縮の選択肢はどれですか?
解答を選択
オプションをタップして解答を確認してください。
正解: Snappy で圧縮された Apache Parquet 形式.
これが解答である理由
Snappyで圧縮されたApache Parquet形式は、クエリ時間を短縮し、ストレージコストを削減するのに最適です。Parquetは列指向のストレージ形式であり、Athenaがクエリに必要な列のみを読み込むため、I/Oが大幅に削減され、クエリパフォーマンスが向上します。Snappyは高速な圧縮アルゴリズムであり、データの読み込み速度を損なうことなくストレージを最適化します。 zipで圧縮された.csv形式は行指向であり、クエリのたびに全行をスキャンする必要があるため、非効率的です。bzip2で圧縮されたJSON形式も行指向であり、bzip2はSnappyよりも圧縮率が高いですが、解凍に時間がかかります。LZOで圧縮されたApache Avro形式は行指向であり、Parquetのような列指向の利点はありません。
試験に合格 — 終わりのない解答探しなしで
この試験のすべての検証済み問題と解説を1か所で入手し、準備時間を大幅に節約しましょう。1,000以上の認定 · 20以上の言語 · 無料で開始。
試験に早く合格する → カード不要