データサイエンティストがSQLを使用してHiveスタイルのパーティショニングでORCファイルをクエリできるように、オンプレミスのHiveに影響を与えることなく、費用対効果の高い分析環境が必要です。どうすればよいですか?
解答を選択
オプションをタップして解答を確認してください。
正解: Cloud StorageにORCファイルをコピーし、データサイエンティストチームのために外部BigQueryテーブルを作成します。.
これが解答である理由
このシナリオでは、オンプレミスのHive環境に影響を与えずに、既存のORCファイルとHiveスタイルのパーティショニングを活用して費用対効果の高い分析環境を構築する必要があります。Cloud StorageにORCファイルをコピーし、その上に外部BigQueryテーブルを作成することで、データサイエンティストは使い慣れたSQLを使用してBigQueryから直接データをクエリできます。BigQueryはサーバーレスで、クエリされたデータ量に対してのみ課金されるため、費用対効果が高く、Dataprocクラスタをデプロイするよりも運用が簡単です。BigtableはNoSQLデータベースであり、このユースケースには適していません。ORCファイルをBigQueryテーブルにインポートすると、ストレージコストが発生し、元のHiveパーティショニングのメリットが失われる可能性があります。
試験に合格 — 終わりのない解答探しなしで
この試験のすべての検証済み問題と解説を1か所で入手し、準備時間を大幅に節約しましょう。1,000以上の認定 · 20以上の言語 · 無料で開始。
試験に早く合格する → カード不要