Inżynier danych musi utrzymywać centralne repozytorium metadanych, które jest dostępne z zapytań Amazon EMR i Amazon Athena, i musi zaimportować do niego istniejące metadane Apache Hive przy minimalnym wysiłku programistycznym. Które rozwiązanie powinien zastosować?
Wybierz odpowiedź
Dotknij opcji, aby sprawdzić swoją odpowiedź.
Poprawna odpowiedź: Użyj AWS Glue Data Catalog..
Dlaczego to jest odpowiedź
AWS Glue Data Catalog jest centralnym repozytorium metadanych, które jest w pełni zarządzane i kompatybilne z Apache Hive Metastore. Umożliwia to łatwe importowanie istniejących metadanych Hive z minimalnym wysiłkiem programistycznym. Data Catalog jest natywnie integrowany z Amazon EMR i Amazon Athena, co pozwala na bezproblemowy dostęp do metadanych z obu usług. Opcja "Użyj Amazon EMR i Apache Ranger" jest nieprawidłowa, ponieważ Apache Ranger służy do zarządzania autoryzacją, a nie do przechowywania metadanych. Opcja "Użyj Hive metastore na klastrze EMR" jest nieprawidłowa, ponieważ jest to rozwiązanie tymczasowe i niezapewniające centralnego, trwałego repozytorium metadanych dostępnego poza konkretnym klastrem EMR. Opcja "Użyj metastore na instancji bazy danych Amazon RDS for MySQL" jest możliwa, ale wymagałaby ręcznego zarządzania i integracji, co jest bardziej złożone niż użycie AWS Glue Data Catalog.
Zdaj egzamin — bez niekończącego się szukania odpowiedzi
Uzyskaj wszystkie zweryfikowane pytania i wyjaśnienia do tego egzaminu w jednym miejscu i zaoszczędź godziny przygotowań. Ponad 1000 certyfikacji · Ponad 20 języków · Zacznij za darmo.
Zdaj egzamin szybciej → Karta nie jest wymagana