Wstępne przetwarzanie Dataflow odczytuje wiele logów BigQuery; wydajność jest niska, a dane szybko rosną. Która zmiana poprawi wydajność odczytu?
Wybierz odpowiedź
Dotknij opcji, aby sprawdzić swoją odpowiedź.
Poprawna odpowiedź: Użycie odczytu .fromQuery (opartego na zapytaniu), który wybiera tylko potrzebne pola..
Dlaczego to jest odpowiedź
Użycie odczytu .fromQuery() z zapytaniem, które wybiera tylko niezbędne pola, jest najskuteczniejszą metodą poprawy wydajności. Zmniejsza to ilość danych przesyłanych z BigQuery do Dataflow, co jest kluczowe przy dużych i szybko rosnących zbiorach danych. Przetwarzanie mniejszej ilości danych jest szybsze i zużywa mniej zasobów. Jawne określenie TableReference nie wpływa znacząco na wydajność odczytu, ponieważ jedynie identyfikuje tabelę. Użycie TableSchema i TableFieldSchema służy do definiowania schematu, a nie do optymalizacji odczytu danych. Transformacja zwracająca obiekty TableRow jest standardowym sposobem reprezentacji danych w Dataflow, ale nie optymalizuje samego procesu odczytu z BigQuery.
Zdaj egzamin — bez niekończącego się szukania odpowiedzi
Uzyskaj wszystkie zweryfikowane pytania i wyjaśnienia do tego egzaminu w jednym miejscu i zaoszczędź godziny przygotowań. Ponad 1000 certyfikacji · Ponad 20 języków · Zacznij za darmo.
Zdaj egzamin szybciej → Karta nie jest wymagana