IoTデバイスのフリートは、永続的なAmazon EMRクラスター上のHDFSにORCファイルとしてデータを書き込みます。アナリストは、同じEMRクラスターでApache Prestoを使用してSQLクエリを実行します。クエリは大量のデータをスキャンし、常に15分以内に完了し、午後5時から午後10時の間にのみ実行されます。会社は、SQLクエリを可能にする、より費用対効果の高いソリューションを求めています。最も費用対効果が高く、要件を満たすソリューションはどれですか?
解答を選択
オプションをタップして解答を確認してください。
正解: データをAmazon S3に保存し、AWS Glue Data Catalogを使用し、Amazon Athenaでクエリを実行します。.
これが解答である理由
正解は、データをAmazon S3に保存し、AWS Glue Data Catalogを使用し、Amazon Athenaでクエリを実行する、です。このソリューションは、サーバーレスであるため、使用した分だけ課金され、EMRクラスターを永続的に実行する必要がないため、最も費用対効果が高くなります。AthenaはS3上のデータに対して直接クエリを実行でき、Glue Data Catalogはスキーマ管理を提供します。 Amazon Redshift SpectrumはS3上のデータにクエリできますが、Redshiftクラスターが必要であり、Redshiftクラスターのコストが発生します。データをEMRクラスター上のEMRFSに保持し続ける場合、永続的なEMRクラスターのコストがかかり、費用対効果が低くなります。データをAmazon Redshiftにロードする場合、データのロードとストレージのコストが発生し、分析要件に対して過剰な場合があります。
試験に合格 — 終わりのない解答探しなしで
この試験のすべての検証済み問題と解説を1か所で入手し、準備時間を大幅に節約しましょう。1,000以上の認定 · 20以上の言語 · 無料で開始。
試験に早く合格する → カード不要