GoogleGoogle Professional Data Engineer (PDE) Certification
·JA
·更新日 21 Aug 2026
ORCファイルをCloud Storageバケットに移行し、DataprocクラスターでHiveを使用したいと考えています。必要に応じて、パフォーマンスのためにデータをHDFSにレプリケートすることも検討しています。DataprocでHiveの使用を開始できる2つの方法は何ですか?(2つ選択してください。)
解答を選択
オプションをタップして解答を確認してください。
正解: gsutilを実行して、すべてのORCファイルをCloud Storageバケットからマスターノードに転送し、Hadoopユーティリティを使用してそれらをHDFSにコピーし、HDFSからHiveテーブルをマウントする, Hadoop用Cloud Storageコネクタを使用してORCファイルを外部Hiveテーブルとして公開し、それらの外部テーブルをネイティブHiveテーブルにレプリケートする.
これが解答である理由
最初の正解は、Cloud StorageからDataprocクラスターのマスターノードにファイルを転送し、そこからHadoopユーティリティ(例: hdfs dfs -put)を使用してHDFSにコピーする方法を示しています。これは、Cloud StorageからHDFSへのデータ移動の一般的なパターンです。2番目の正解は、Hadoop用Cloud Storageコネクタを利用して、Cloud Storage上のORCファイルを直接外部Hiveテーブルとして公開する方法です。これにより、データはHDFSに物理的に移動されませんが、Hiveからアクセス可能になります。パフォーマンス要件に応じて、これらの外部テーブルのデータをHDFS上のネイティブHiveテーブルにレプリケートすることも可能です。
不正解の選択肢は、HDFSへの直接転送がgsutilではできない点や、任意のノードへの転送ではHiveが直接利用できない点、BigQueryを介するアプローチが質問の意図(ORCファイルをHiveで使用する)から外れるため誤りです。
試験に合格 — 終わりのない解答探しなしで
この試験のすべての検証済み問題と解説を1か所で入手し、準備時間を大幅に節約しましょう。1,000以上の認定 · 20以上の言語 · 無料で開始。
試験に早く合格する →
カード不要