Cloud Pub/Sub メッセージを BigQuery の小さな静的参照データ(ワーカーメモリに収まる)でエンリッチし、エンリッチされた行を BigQuery に書き込む Apache Beam パイプラインが必要です。どのジョブタイプと変換を使用すべきですか?
解答を選択
オプションをタップして解答を確認してください。
正解: ストリーミングジョブ、PubSubIO、BigQueryIO、サイド入力.
これが解答である理由
このシナリオでは、リアルタイムでPub/Subメッセージを処理し、BigQueryに書き込む必要があるため、「ストリーミングジョブ」が適切です。Pub/Subからの読み取りには「PubSubIO」を、BigQueryへの書き込みには「BigQueryIO」を使用します。参照データがワーカーメモリに収まる小さな静的データであるため、各メッセージをエンリッチするために「サイド入力」として利用するのが最も効率的です。これにより、参照データを一度読み込み、パイプラインのすべてのワーカーで利用できます。「サイド出力」は、メインのPCollectionとは異なる種類のデータを書き出す場合に使用しますが、ここではエンリッチされたデータがメインの出力であるため不適切です。「JdbcIO」はリレーショナルデータベースへの接続に使用され、BigQueryには直接適用されません。
試験に合格 — 終わりのない解答探しなしで
この試験のすべての検証済み問題と解説を1か所で入手し、準備時間を大幅に節約しましょう。1,000以上の認定 · 20以上の言語 · 無料で開始。
試験に早く合格する → カード不要