Inżynier danych uruchamia zapytania Amazon Athena na danych w Amazon S3 i używa AWS Glue Data Catalog do metadanych. Planowanie zapytań jest powolne, ponieważ zestaw danych S3 ma bardzo dużą liczbę partycji. Które działania skrócą czas planowania Athena i rozwiążą problem wąskiego gardła? (Wybierz dwie odpowiedzi.)
Wybierz odpowiedź
Dotknij opcji, aby sprawdzić swoją odpowiedź.
Poprawna odpowiedź: Utwórz indeks partycji AWS Glue. Włącz filtrowanie partycji., Użyj projekcji partycji Athena opartej na prefiksie zasobnika S3..
Dlaczego to jest odpowiedź
Utworzenie indeksu partycji AWS Glue i włączenie filtrowania partycji znacząco przyspiesza planowanie zapytań Athena, ponieważ indeks umożliwia Athene szybkie odnajdywanie odpowiednich partycji bez skanowania wszystkich metadanych. Użycie projekcji partycji Athena opartej na prefiksie zasobnika S3 również poprawia wydajność, ponieważ Athena może wywnioskować lokalizacje partycji na podstawie wzorca, zamiast odpytywać katalog Glue dla każdej partycji. Dzielenie danych na grupy (bucketing) może poprawić wydajność zapytań, ale nie rozwiązuje problemu powolnego planowania partycji. Konwersja do formatu Parquet poprawia wydajność skanowania danych, ale nie planowania partycji. Łączenie mniejszych obiektów poprawia wydajność odczytu, ale nie bezpośrednio planowania partycji.
Zdaj egzamin — bez niekończącego się szukania odpowiedzi
Uzyskaj wszystkie zweryfikowane pytania i wyjaśnienia do tego egzaminu w jednym miejscu i zaoszczędź godziny przygotowań. Ponad 1000 certyfikacji · Ponad 20 języków · Zacznij za darmo.
Zdaj egzamin szybciej → Karta nie jest wymagana