Firma musi pozyskiwać dane z Amazon S3, Amazon Redshift i Snowflake do Amazon SageMaker Data Wrangler. Pozyskane dane muszą zawsze odzwierciedlać najnowsze zmiany w systemach źródłowych. Które podejście spełnia ten wymóg?
Wybierz odpowiedź
Dotknij opcji, aby sprawdzić swoją odpowiedź.
Poprawna odpowiedź: Użyj skatalogowanych połączeń, aby zaimportować dane ze źródeł do Data Wrangler..
Dlaczego to jest odpowiedź
Użycie skatalogowanych połączeń (cataloged connections) jest prawidłowym podejściem, ponieważ SageMaker Data Wrangler może integrować się z AWS Glue Data Catalog. Katalogowanie danych w Glue Data Catalog pozwala na automatyczne wykrywanie schematów i metadanych, co zapewnia, że Data Wrangler zawsze odczytuje najnowsze zmiany w strukturze i zawartości danych ze źródeł takich jak S3, Redshift i Snowflake. Bezpośrednie połączenia mogą nie oferować tej samej elastyczności w zarządzaniu zmieniającymi się schematami. Użycie AWS Glue lub AWS Lambda do bezpośredniego importowania danych do Data Wrangler jest zbędne, ponieważ Data Wrangler ma wbudowane konektory do tych źródeł, a dodatkowe usługi wprowadzałyby niepotrzebną złożoność i koszty.
Zdaj egzamin — bez niekończącego się szukania odpowiedzi
Uzyskaj wszystkie zweryfikowane pytania i wyjaśnienia do tego egzaminu w jednym miejscu i zaoszczędź godziny przygotowań. Ponad 1000 certyfikacji · Ponad 20 języków · Zacznij za darmo.
Zdaj egzamin szybciej → Karta nie jest wymagana