ソリューションアーキテクトが、大量の半構造化データをAmazon S3バケットに保存する分析アプリケーションを管理しています。アーキテクトは、処理を高速化するために並列データ処理を行い、Amazon Redshiftデータベースに保存されている情報を使用してデータをエンリッチしたいと考えています。これらの要件を満たすソリューションはどれですか?
解答を選択
オプションをタップして解答を確認してください。
正解: Amazon EMRを使用してS3データを処理します。Amazon EMRをAmazon Redshiftデータとともに使用してS3データをエンリッチします。.
これが解答である理由
Amazon EMRは、Apache SparkやHadoopなどのフレームワークを使用して、S3に保存された大量の半構造化データを並列処理するのに最適です。EMRはRedshiftへのコネクタも提供しており、S3データを処理しながらRedshiftのデータで直接エンリッチすることが可能です。 Amazon AthenaはS3データのクエリには適していますが、大規模な並列処理やRedshiftとの直接的なエンリッチメント機能はEMRほど強力ではありません。AWS GlueはETLサービスであり、データ処理には使用できますが、並列処理の能力やRedshiftとの統合の柔軟性ではEMRが優れています。Amazon Kinesis Data Streamsはリアルタイムデータ処理向けであり、既存のS3データのバッチ処理やエンリッチメントには適していません。AWS Lake Formationはデータレイクのセキュリティとガバナンスを管理するサービスであり、データ処理やエンリッチメントの主要なツールではありません。
試験に合格 — 終わりのない解答探しなしで
この試験のすべての検証済み問題と解説を1か所で入手し、準備時間を大幅に節約しましょう。1,000以上の認定 · 20以上の言語 · 無料で開始。
試験に早く合格する → カード不要