AmazonAmazon Data Engineer Associate DEA-C01 Certification·NL·Bijgewerkt 2 Aug 2026
U moet een ETL-pipeline bouwen die elke 15 minuten bestanden (CSV, JSON of Parquet) van 10 bronsystemen in 10 Amazon Redshift-tabellen opneemt. Alle bestanden komen terecht in één S3-bucket; de bestandsgroottes variëren van 10 MB tot 20 GB. De pipeline moet schemaconformiteit kunnen tolereren. Welke oplossingen voldoen aan deze vereisten? (Kies er twee.)
Kies een antwoord
Tik op een optie om je antwoord te controleren.
Correct antwoord: Gebruik een Amazon EventBridge-regel om elke 15 minuten een AWS Glue-workflowtaak aan te roepen. Configureer de AWS Glue-workflow met een on-demand trigger die een AWS Glue crawler uitvoert en vervolgens een AWS Glue-taak uitvoert wanneer de crawler succesvol is voltooid. Configureer de AWS Glue-taak om de gegevens te verwerken en in de Amazon Redshift-tabellen te laden., Configureer een AWS Lambda-functie om een AWS Glue-workflow aan te roepen wanneer een bestand in de S3-bucket wordt geladen. Configureer de AWS Glue-workflow met een on-demand trigger die een AWS Glue crawler uitvoert en vervolgens een AWS Glue-taak uitvoert wanneer de crawler succesvol is voltooid. Configureer de AWS Glue-taak om de gegevens te verwerken en in de Amazon Redshift-tabellen te laden..
Waarom dit het antwoord is
De twee correcte opties bieden robuuste en schaalbare oplossingen voor de gespecificeerde ETL-pipeline.
De eerste correcte optie gebruikt een EventBridge-regel om elke 15 minuten een AWS Glue-workflow te starten. Deze workflow omvat een Glue crawler voor schemadetectie en een Glue-taak voor gegevensverwerking en laden naar Redshift. Dit voldoet aan de vereiste van periodieke uitvoering en schemaconformiteit.
De tweede correcte optie gebruikt een Lambda-functie die wordt geactiveerd bij het uploaden van een bestand naar S3. Deze Lambda-functie roept vervolgens een AWS Glue-workflow aan die, net als in de eerste optie, een crawler en een Glue-taak uitvoert. Dit is ideaal voor event-gedreven verwerking en voldoet ook aan de vereisten voor schemaconformiteit en het laden naar Redshift.
De optie die alleen een AWS Glue-taak gebruikt zonder crawler, mist de mogelijkheid om schemaconformiteit te tolereren, wat een belangrijke vereiste is. De optie met meerdere Lambda-functies en handmatige orkestratie is complexer en minder efficiënt dan een Glue-workflow. De optie die Kinesis Data Firehose gebruikt, is niet optimaal voor de variërende bestandsgroottes (tot 20 GB) en de behoefte aan schemadetectie via een crawler, en voegt onnodige complexiteit toe.
Slaag voor je examen — zonder eindeloos zoeken naar antwoorden
Krijg elke geverifieerde vraag en uitleg voor dit examen op één plek, en bespaar uren voorbereiding. Meer dan 1.000 certificeringen · Meer dan 20 talen · gratis om te beginnen.