Inżynier danych musi poprawić wydajność zapytań SQL na klastrze Amazon Redshift, ale nie może zwiększyć rozmiaru klastra. Dane są dystrybuowane w stylu dystrybucji EVEN. Niektóre tabele mają setki GB, inne poniżej 10 MB. Które podejście poprawi wydajność, biorąc pod uwagę ograniczenia?
Wybierz odpowiedź
Dotknij opcji, aby sprawdzić swoją odpowiedź.
Poprawna odpowiedź: Użycie stylu dystrybucji ALL dla rzadko aktualizowanych małych tabel. Określenie kluczy podstawowych i obcych dla wszystkich tabel..
Dlaczego to jest odpowiedź
Poprawna odpowiedź to użycie stylu dystrybucji ALL dla rzadko aktualizowanych małych tabel i określenie kluczy podstawowych i obcych. Dystrybucja ALL replikuje całą tabelę na każdym węźle obliczeniowym, co eliminuje ruch danych dla złączeń z tą tabelą. Jest to efektywne dla małych, rzadko aktualizowanych tabel, ponieważ koszt replikacji jest niski, a korzyści z braku przesyłania danych podczas zapytań są znaczące. Określenie kluczy podstawowych i obcych pomaga optymalizatorowi zapytań Redshift w tworzeniu bardziej efektywnych planów wykonania. Dalsze używanie dystrybucji EVEN dla wszystkich tabel nie poprawi wydajności, ponieważ nie rozwiązuje problemu potencjalnego przesyłania danych. Użycie dystrybucji ALL dla dużych tabel jest nieefektywne ze względu na wysoki koszt replikacji i zużycie pamięci. Redshift nie obsługuje partycjonowania tabel, co eliminuje ostatnią opcję.
Zdaj egzamin — bez niekończącego się szukania odpowiedzi
Uzyskaj wszystkie zweryfikowane pytania i wyjaśnienia do tego egzaminu w jednym miejscu i zaoszczędź godziny przygotowań. Ponad 1000 certyfikacji · Ponad 20 języków · Zacznij za darmo.
Zdaj egzamin szybciej → Karta nie jest wymagana