Sie müssen eine ETL-Pipeline erstellen, die Dateien (CSV, JSON oder Parquet), die alle 15 Minuten von 10 Quellsystemen geliefert werden, in 10 Amazon Redshift-Tabellen aufnimmt. Alle Dateien landen in einem einzigen S3-Bucket; die Dateigrößen variieren von 10 MB bis 20 GB. Die Pipeline muss Schemaänderungen tolerieren. Welche Lösungen erfüllen diese Anforderungen? (Wählen Sie zwei.)
Wählen Sie eine Antwort
Tippen Sie auf eine Option, um Ihre Antwort zu überprüfen.
Richtige Antwort: Verwenden Sie eine Amazon EventBridge-Regel, um alle 15 Minuten einen AWS Glue-Workflow-Job aufzurufen. Konfigurieren Sie den AWS Glue-Workflow so, dass er einen On-Demand-Trigger hat, der einen AWS Glue-Crawler ausführt und dann einen AWS Glue-Job ausführt, wenn der Crawler erfolgreich beendet wurde. Konfigurieren Sie den AWS Glue-Job so, dass er die Daten verarbeitet und in die Amazon Redshift-Tabellen lädt., Konfigurieren Sie eine AWS Lambda-Funktion, um einen AWS Glue-Workflow aufzurufen, wenn eine Datei in den S3-Bucket geladen wird. Konfigurieren Sie den AWS Glue-Workflow so, dass er einen On-Demand-Trigger hat, der einen AWS Glue-Crawler ausführt und dann einen AWS Glue-Job ausführt, wenn der Crawler erfolgreich beendet wurde. Konfigurieren Sie den AWS Glue-Job so, dass er die Daten verarbeitet und in die Amazon Redshift-Tabellen lädt..
Warum dies die Antwort ist
Die korrekten Optionen nutzen AWS Glue Workflows mit Crawlern, um Schemaänderungen zu erkennen und die Daten in Redshift zu laden. Workflows orchestrieren die Schritte (Crawler, Job) und ermöglichen die Verarbeitung großer Dateien sowie die Schemaerkennung, was für die Anforderung der Schemaänderungstoleranz entscheidend ist. Die erste inkorrekte Option verwendet nur einen Glue Job, der Schemaänderungen nicht automatisch erkennt und verarbeitet. Die dritte Option ist zu komplex und ineffizient mit mehreren Lambda-Funktionen und EventBridge-Regeln, die einen Glue Crawler und Job separat aufrufen. Die vierte Option ist ungeeignet, da Kinesis Data Firehose für Streaming-Daten konzipiert ist und die Dateigrößen von bis zu 20 GB nicht effizient verarbeitet werden können, zudem ist die Schemaerkennung nicht integriert.
Bestehen Sie Ihre Prüfung – ohne endlose Antwortsuche
Erhalten Sie jede verifizierte Frage und Erklärung für diese Prüfung an einem Ort und sparen Sie Stunden der Vorbereitung. Über 1.000 Zertifizierungen · Über 20 Sprachen · Kostenloser Start.
Bestehen Sie Ihre Prüfung schneller → Keine Karte erforderlich