Musisz przechowywać surowe, nieustrukturyzowane dane źródłowe dokładnie tak, jak zostały pobrane (schemat może ulec zmianie) do późniejszego ponownego przetwarzania. Gdzie należy umieścić surowe dane i w jaki sposób potoki powinny uzyskiwać do nich dostęp?
Wybierz odpowiedź
Dotknij opcji, aby sprawdzić swoją odpowiedź.
Poprawna odpowiedź: Przechowuj dane w zasobniku Cloud Storage. Zaprojektuj potoki przetwarzania tak, aby pobierały dane z zasobnika..
Dlaczego to jest odpowiedź
Prawidłowa odpowiedź to przechowywanie danych w zasobniku Cloud Storage i pobieranie ich stamtąd przez potoki. Cloud Storage jest idealny do przechowywania surowych, nieustrukturyzowanych danych w dowolnym formacie, co jest kluczowe, gdy schemat może się zmieniać. Zapewnia wysoką trwałość, dostępność i skalowalność, a także jest ekonomiczny. Potoki przetwarzania mogą łatwo uzyskiwać dostęp do tych danych. Pozostałe opcje są nieprawidłowe, ponieważ BigQuery jest bazą danych analitycznych wymagającą zdefiniowanego schematu, co nie pasuje do wymogu przechowywania danych dokładnie tak, jak zostały pobrane, zwłaszcza gdy schemat może się zmieniać. Przetwarzanie danych przed ich zapisaniem do ponownego przetwarzania również jest błędne, ponieważ celem jest przechowywanie surowych danych.
Zdaj egzamin — bez niekończącego się szukania odpowiedzi
Uzyskaj wszystkie zweryfikowane pytania i wyjaśnienia do tego egzaminu w jednym miejscu i zaoszczędź godziny przygotowań. Ponad 1000 certyfikacji · Ponad 20 języków · Zacznij za darmo.
Zdaj egzamin szybciej → Karta nie jest wymagana