Potrzebujesz potoku Apache Beam, który wzbogaca wiadomości Cloud Pub/Sub o małe statyczne dane referencyjne z BigQuery (mieszczące się w pamięci roboczej) i zapisuje wzbogacone wiersze do BigQuery. Jakiego typu zadania i transformacji należy użyć?
Wybierz odpowiedź
Dotknij opcji, aby sprawdzić swoją odpowiedź.
Poprawna odpowiedź: Streaming job, PubSubIO, BigQueryIO, side-inputs.
Dlaczego to jest odpowiedź
Prawidłowa odpowiedź to "Streaming job, PubSubIO, BigQueryIO, side-inputs". Potrzebujesz potoku strumieniowego (Streaming job), ponieważ przetwarzasz wiadomości z Cloud Pub/Sub w czasie rzeczywistym. Do odczytu z Pub/Sub używasz PubSubIO. Do zapisu wzbogaconych danych do BigQuery używasz BigQueryIO. Kluczowym elementem jest użycie side-inputs do wzbogacania danych. Side-inputs pozwalają na efektywne dołączenie małych, statycznych danych referencyjnych (które mieszczą się w pamięci) do każdego elementu w głównym potoku, bez konieczności ponownego odpytywania BigQuery dla każdego komunikatu. Opcja "Batch job" jest nieprawidłowa, ponieważ wymagane jest przetwarzanie strumieniowe. Opcje z "side-outputs" są nieprawidłowe, ponieważ side-outputs służą do rozdzielania danych na różne strumienie wyjściowe, a nie do wzbogacania danych wejściowych. JdbcIO jest używane do interakcji z bazami danych JDBC, a nie z BigQuery.
Zdaj egzamin — bez niekończącego się szukania odpowiedzi
Uzyskaj wszystkie zweryfikowane pytania i wyjaśnienia do tego egzaminu w jednym miejscu i zaoszczędź godziny przygotowań. Ponad 1000 certyfikacji · Ponad 20 języków · Zacznij za darmo.
Zdaj egzamin szybciej → Karta nie jest wymagana