POC linii lotniczych przechowuje codzienne metryki CSV w S3, partycjonowane według daty, i odpytuje je za pomocą Amazon Athena. W miarę wzrostu ilości danych firma chce zoptymalizować przechowywanie, aby poprawić wydajność zapytań. Które dwie czynności powinna podjąć? (Wybierz dwie.)
Wybierz odpowiedź
Dotknij opcji, aby sprawdzić swoją odpowiedź.
Poprawna odpowiedź: Użyj zasobnika S3, który znajduje się w tym samym regionie AWS, w którym firma uruchamia zapytania Athena., Przetwórz wstępnie dane .csv do formatu Apache Parquet, pobierając tylko bloki danych, które są potrzebne do predykatów..
Dlaczego to jest odpowiedź
Użycie zasobnika S3 w tym samym regionie AWS, co Athena, minimalizuje opóźnienia sieciowe i koszty transferu danych, co bezpośrednio poprawia wydajność zapytań. Przetwarzanie danych CSV do formatu Apache Parquet jest korzystne, ponieważ Parquet to format kolumnowy, który pozwala na efektywne skanowanie tylko niezbędnych kolumn i bloków danych (predykatów), redukując ilość danych do przetworzenia przez Athenę. Dodanie losowego ciągu znaków do kluczy S3 jest techniką optymalizacji przepustowości dla zapisu, nie odczytu, i nie wpłynie na wydajność zapytań Atheny. Przetwarzanie danych do formatu JSON nie jest optymalne, ponieważ JSON jest formatem wierszowym, który nie oferuje tych samych korzyści wydajnościowych co formaty kolumnowe, takie jak Parquet, w kontekście zapytań analitycznych.
Zdaj egzamin — bez niekończącego się szukania odpowiedzi
Uzyskaj wszystkie zweryfikowane pytania i wyjaśnienia do tego egzaminu w jednym miejscu i zaoszczędź godziny przygotowań. Ponad 1000 certyfikacji · Ponad 20 języków · Zacznij za darmo.
Zdaj egzamin szybciej → Karta nie jest wymagana