Firma przechowuje codzienne zapisy wydajności portfela w postaci plików .csv w Amazon S3 i używa crawlerów AWS Glue do katalogowania danych. Dane muszą być dostępne w AWS Glue Data Catalog każdego dnia. Jaka konfiguracja spełnia ten wymóg?
Wybierz odpowiedź
Dotknij opcji, aby sprawdzić swoją odpowiedź.
Poprawna odpowiedź: Utwórz rolę IAM, która zawiera politykę AWSGlueServiceRole. Dołącz rolę do crawlera. Skieruj crawlera na ścieżkę źródłową S3. Utwórz codzienny harmonogram uruchamiania crawlera. Określ nazwę bazy danych dla danych wyjściowych..
Dlaczego to jest odpowiedź
Poprawna odpowiedź precyzyjnie opisuje niezbędne kroki do skonfigurowania crawlera AWS Glue. Rola IAM z polityką AWSGlueServiceRole jest wymagana, aby crawler mógł wykonywać operacje katalogowania. Skierowanie crawlera na ścieżkę źródłową S3 jest kluczowe dla identyfikacji danych. Ustalenie codziennego harmonogramu zapewnia, że dane są katalogowane każdego dnia, a określenie nazwy bazy danych jest konieczne do zorganizowania metadanych w Katalogu Danych Glue. Nieprawidłowe opcje: Pierwsza opcja jest błędna, ponieważ polityka AmazonS3FullAccess nie jest wystarczająca dla crawlera Glue; potrzebuje on uprawnień do Glue. Ponadto, crawler nie zapisuje danych wyjściowych do nowej ścieżki S3, lecz metadane do Katalogu Danych Glue. Trzecia opcja jest błędna, ponieważ AmazonS3FullAccess jest niewystarczająca, a przydzielanie DPU (Data Processing Units) jest automatycznie zarządzane przez Glue dla crawlerów i nie jest to konfiguracja, którą użytkownik bezpośrednio "przydziela" w ten sposób do codziennego uruchamiania. Czwarta opcja jest błędna, ponieważ, podobnie jak w pierwszej, crawler nie zapisuje danych wyjściowych do nowej ścieżki S3.
Zdaj egzamin — bez niekończącego się szukania odpowiedzi
Uzyskaj wszystkie zweryfikowane pytania i wyjaśnienia do tego egzaminu w jednym miejscu i zaoszczędź godziny przygotowań. Ponad 1000 certyfikacji · Ponad 20 języków · Zacznij za darmo.
Zdaj egzamin szybciej → Karta nie jest wymagana