Inżynier danych skonfigurował AWS Glue Data Catalog dla obiektów w S3 i potrzebuje przyrostowych aktualizacji. Powiadomienia o zdarzeniach S3 są wysyłane do kolejki SQS. Która kombinacja kroków zapewnia przyrostowe aktualizacje katalogu przy najmniejszym nakładzie operacyjnym? (Wybierz dwie odpowiedzi.)
Wybierz odpowiedź
Dotknij opcji, aby sprawdzić swoją odpowiedź.
Poprawna odpowiedź: Utwórz crawler AWS Glue oparty na zdarzeniach S3, który odczytuje zdarzenia z kolejki SQS., Użyj funkcji AWS Lambda do bezpośredniej aktualizacji Data Catalog na podstawie zdarzeń S3 odebranych przez kolejkę SQS..
Dlaczego to jest odpowiedź
Utworzenie crawlera AWS Glue opartego na zdarzeniach S3, który odczytuje zdarzenia z kolejki SQS, to efektywne rozwiązanie. Crawler automatycznie przetwarza zdarzenia o nowych lub zmienionych obiektach, minimalizując nakład operacyjny. Użycie funkcji AWS Lambda do bezpośredniej aktualizacji Data Catalog na podstawie zdarzeń S3 odebranych przez kolejkę SQS również jest dobrym wyborem. Lambda może wywołać API Glue, aby dodać lub zaktualizować partycje i schematy, oferując elastyczność i kontrolę. Planowanie crawlera na podstawie harmonogramu czasowego nie zapewni przyrostowych aktualizacji w czasie rzeczywistym. Ręczne uruchamianie crawlera jest nieefektywne i zwiększa nakład pracy. Użycie AWS Step Functions jest możliwe, ale zazwyczaj stanowi nadmierną orkiestrację dla tego konkretnego przypadku, zwiększając złożoność.
Zdaj egzamin — bez niekończącego się szukania odpowiedzi
Uzyskaj wszystkie zweryfikowane pytania i wyjaśnienia do tego egzaminu w jednym miejscu i zaoszczędź godziny przygotowań. Ponad 1000 certyfikacji · Ponad 20 języków · Zacznij za darmo.
Zdaj egzamin szybciej → Karta nie jest wymagana