Analityk danych będzie używał Amazon SageMaker Data Wrangler do pozyskiwania historycznych danych z S3 w celu eksploracyjnej analizy danych (EDA) i znajdowania rzadkich anomalii. Aby zminimalizować zasoby obliczeniowe podczas wykonywania EDA, którą opcję importu powinien wybrać analityk danych?
Wybierz odpowiedź
Dotknij opcji, aby sprawdzić swoją odpowiedź.
Poprawna odpowiedź: Importuj dane, używając opcji First K, wybierając K na podstawie wiedzy dziedzinowej..
Dlaczego to jest odpowiedź
Analityk danych powinien wybrać opcję "First K" (pierwsze K), aby zaimportować tylko początkową część danych. To minimalizuje zużycie zasobów obliczeniowych, ponieważ do EDA i wstępnego wykrywania anomalii przetwarzany jest tylko podzbiór danych, a nie cały zbiór. Wybór odpowiedniego K na podstawie wiedzy dziedzinowej pozwala na reprezentatywne próbkowanie bez przeciążania zasobów. Opcja "None" zaimportowałaby wszystkie dane, zwiększając koszty. "Stratified" (stratyfikowane) i "Randomized" (losowe) próbkowanie są bardziej odpowiednie, gdy potrzebna jest statystycznie reprezentatywna próbka całego zbioru danych, co zużywa więcej zasobów niż "First K" dla wstępnej EDA.
Zdaj egzamin — bez niekończącego się szukania odpowiedzi
Uzyskaj wszystkie zweryfikowane pytania i wyjaśnienia do tego egzaminu w jednym miejscu i zaoszczędź godziny przygotowań. Ponad 1000 certyfikacji · Ponad 20 języków · Zacznij za darmo.
Zdaj egzamin szybciej → Karta nie jest wymagana