Firma świadcząca usługi finansowe buduje bezserwerowe jezioro danych na Amazon S3, które musi: umożliwiać wykonywanie zapytań na starych i nowych danych S3 za pomocą Amazon Athena i Redshift Spectrum, obsługiwać potoki ETL sterowane zdarzeniami oraz zapewniać łatwe odkrywanie metadanych. Które rozwiązanie spełnia te wymagania?
Wybierz odpowiedź
Dotknij opcji, aby sprawdzić swoją odpowiedź.
Poprawna odpowiedź: Użyj crawlera AWS Glue do katalogowania danych S3, uruchamiaj zadania AWS Glue ETL za pomocą AWS Lambda i używaj AWS Glue Data Catalog do odkrywania metadanych..
Dlaczego to jest odpowiedź
Prawidłowa odpowiedź spełnia wszystkie wymagania. AWS Glue crawler automatycznie kataloguje dane w S3, tworząc schematy i tabele w AWS Glue Data Catalog, który jest kompatybilny z Amazon Athena i Redshift Spectrum, umożliwiając łatwe odkrywanie metadanych. Zadania AWS Glue ETL są idealne do przetwarzania danych w jeziorze danych, a uruchamianie ich za pomocą AWS Lambda pozwala na tworzenie potoków sterowanych zdarzeniami (np. po dodaniu nowych plików do S3). Pozostałe opcje są nieprawidłowe, ponieważ: użycie AWS Batch zamiast AWS Glue ETL jest mniej optymalne dla zadań ETL w jeziorze danych; użycie zewnętrznego metastore Apache Hive komplikuje zarządzanie i integrację w AWS; a uruchamianie zadań za pomocą alarmów CloudWatch jest mniej elastyczne niż Lambda dla potoków sterowanych zdarzeniami.
Zdaj egzamin — bez niekończącego się szukania odpowiedzi
Uzyskaj wszystkie zweryfikowane pytania i wyjaśnienia do tego egzaminu w jednym miejscu i zaoszczędź godziny przygotowań. Ponad 1000 certyfikacji · Ponad 20 języków · Zacznij za darmo.
Zdaj egzamin szybciej → Karta nie jest wymagana