Firma przesyła strumieniowo rekordy CSV w czasie rzeczywistym i chce je przechowywać na Amazon S3 w formacie Apache Parquet. Która opcja wymaga najmniejszego wysiłku deweloperskiego, aby przekonwertować przychodzące dane CSV na Parquet przed zapisaniem ich w S3?
Wybierz odpowiedź
Dotknij opcji, aby sprawdzić swoją odpowiedź.
Poprawna odpowiedź: Użyj Amazon Kinesis Data Streams i Amazon Kinesis Data Firehose do transformacji przychodzących CSV na Parquet..
Dlaczego to jest odpowiedź
Prawidłowa odpowiedź to użycie Amazon Kinesis Data Streams i Amazon Kinesis Data Firehose do transformacji przychodzących CSV na Parquet. Kinesis Data Firehose natywnie wspiera konwersję formatów danych (np. z CSV na Parquet) przed dostarczeniem ich do S3, co minimalizuje wysiłek deweloperski, ponieważ jest to usługa zarządzana. Pozostałe opcje wymagają większego wysiłku deweloperskiego lub zarządzania infrastrukturą: Apache Kafka Streams na EC2 wymaga zarządzania instancjami EC2 i konfiguracji Kafka Streams oraz Kafka Connect. Użycie AWS Glue po pozyskaniu danych przez Kinesis Data Streams oznacza uruchamianie zadań Glue, co jest dodatkowym krokiem i wymaga konfiguracji. Apache Spark Structured Streaming na klastrze EMR wiąże się z zarządzaniem klastrem EMR i pisaniem kodu Spark, co jest najbardziej złożonym rozwiązaniem.
Zdaj egzamin — bez niekończącego się szukania odpowiedzi
Uzyskaj wszystkie zweryfikowane pytania i wyjaśnienia do tego egzaminu w jednym miejscu i zaoszczędź godziny przygotowań. Ponad 1000 certyfikacji · Ponad 20 języków · Zacznij za darmo.
Zdaj egzamin szybciej → Karta nie jest wymagana