Migrowano pliki ORC do zasobnika Cloud Storage i chcesz używać Hive na klastrze Dataproc, opcjonalnie replikując dane do HDFS w celu zwiększenia wydajności. Które dwie metody pozwalają rozpocząć korzystanie z Hive na Dataproc? (Wybierz dwie.)
Wybierz odpowiedź
Dotknij opcji, aby sprawdzić swoją odpowiedź.
Poprawna odpowiedź: Uruchom gsutil, aby przenieść wszystkie pliki ORC z zasobnika Cloud Storage do węzła głównego, a następnie użyj narzędzi Hadoop do skopiowania ich do HDFS i zamontuj tabele Hive z HDFS, Użyj konektora Cloud Storage dla Hadoop, aby udostępnić pliki ORC jako zewnętrzne tabele Hive, a następnie zreplikuj te zewnętrzne tabele do natywnych tabel Hive.
Dlaczego to jest odpowiedź
Prawidłowe opcje to: "Uruchom gsutil, aby przenieść wszystkie pliki ORC z zasobnika Cloud Storage do węzła głównego, a następnie użyj narzędzi Hadoop do skopiowania ich do HDFS i zamontuj tabele Hive z HDFS" oraz "Użyj konektora Cloud Storage dla Hadoop, aby udostępnić pliki ORC jako zewnętrzne tabele Hive, a następnie zreplikuj te zewnętrzne tabele do natywnych tabel Hive". Pierwsza opcja opisuje ręczne przeniesienie danych do HDFS, co jest możliwe, choć mniej zautomatyzowane. Druga opcja jest preferowanym podejściem, wykorzystującym konektor Cloud Storage dla Hadoop, który pozwala Hive bezpośrednio odczytywać pliki z Cloud Storage, a następnie opcjonalnie replikować je do HDFS dla wydajności. Pozostałe opcje są nieprawidłowe, ponieważ gsutil nie przenosi bezpośrednio do HDFS, a ładowanie do BigQuery i używanie konektora BigQuery jest niepotrzebnym krokiem, gdy dane są już w Cloud Storage.
Zdaj egzamin — bez niekończącego się szukania odpowiedzi
Uzyskaj wszystkie zweryfikowane pytania i wyjaśnienia do tego egzaminu w jednym miejscu i zaoszczędź godziny przygotowań. Ponad 1000 certyfikacji · Ponad 20 języków · Zacznij za darmo.
Zdaj egzamin szybciej → Karta nie jest wymagana