Analityk danych musi zbadać około 500 GB historycznych danych inwentaryzacyjnych przechowywanych jako pliki CSV w jeziorze danych Amazon S3. Chce używać SQL do eksploracji, a firma chce zminimalizować koszty i nakład pracy operacyjnej. Które podejście spełnia te wymagania przy najmniejszym zarządzaniu operacyjnym?
Wybierz odpowiedź
Dotknij opcji, aby sprawdzić swoją odpowiedź.
Poprawna odpowiedź: Użyj AWS Glue do przeszukania zasobnika S3 i wypełnienia AWS Glue Data Catalog, a następnie wykonaj zapytanie do danych za pomocą Amazon Athena..
Dlaczego to jest odpowiedź
Prawidłowa odpowiedź to użycie AWS Glue do przeszukania zasobnika S3 i wypełnienia AWS Glue Data Catalog, a następnie zapytania danych za pomocą Amazon Athena. To podejście jest bezserwerowe, co minimalizuje nakład pracy operacyjnej i koszty, ponieważ płaci się tylko za wykonane zapytania. Athena umożliwia eksplorację danych w S3 za pomocą standardowego SQL. Uruchomienie klastra Amazon EMR wymaga zarządzania serwerami i jest droższe. Amazon Redshift, zarówno w przypadku importowania danych, jak i tworzenia tabel zewnętrznych, wiąże się z utrzymaniem klastra i stałymi kosztami, co zwiększa nakład pracy operacyjnej i koszty.
Zdaj egzamin — bez niekończącego się szukania odpowiedzi
Uzyskaj wszystkie zweryfikowane pytania i wyjaśnienia do tego egzaminu w jednym miejscu i zaoszczędź godziny przygotowań. Ponad 1000 certyfikacji · Ponad 20 języków · Zacznij za darmo.
Zdaj egzamin szybciej → Karta nie jest wymagana