ある航空会社の概念実証(POC)では、日次のCSVメトリクスを日付でパーティション分割してS3に保存し、Amazon Athenaでクエリしています。データが増えるにつれて、同社はクエリパフォーマンスを向上させるためにストレージを最適化したいと考えています。同社が取るべき2つのアクションはどれですか?(2つ選択してください。)
解答を選択
オプションをタップして解答を確認してください。
正解: 同社がAthenaクエリを実行するのと同じAWSリージョンにあるS3バケットを使用します。, 述語に必要なデータブロックのみをフェッチして、.csvデータをApache Parquet形式に前処理します。.
これが解答である理由
Athenaは、クエリ対象のS3バケットがAthenaを実行するリージョンと同じである場合に最高のパフォーマンスを発揮します。リージョン間のデータ転送はレイテンシーとコストを増加させます。CSV形式は行指向であり、クエリが特定の列のみを必要とする場合でも行全体を読み込むため非効率的です。Apache Parquetは列指向のストレージ形式であり、述語プッシュダウンをサポートするため、クエリに必要なデータブロックのみを効率的にフェッチし、データスキャン量を大幅に削減してクエリパフォーマンスを向上させます。S3キーにランダムな文字列を追加することは、S3のパフォーマンスを向上させる一般的な方法ですが、Athenaクエリのパフォーマンスに直接的な影響はほとんどありません。JSON形式への変換は、CSVよりは柔軟ですが、Parquetのような列指向の最適化されたパフォーマンスは提供しません。
試験に合格 — 終わりのない解答探しなしで
この試験のすべての検証済み問題と解説を1か所で入手し、準備時間を大幅に節約しましょう。1,000以上の認定 · 20以上の言語 · 無料で開始。
試験に早く合格する → カード不要