Welk Hadoop-programmeermodel is geschikt voor ETL-pijplijnen die checkpointing en pijplijn-splitsing vereisen?
Kies een antwoord
Tik op een optie om je antwoord te controleren.
Correct antwoord: PigLatin met Pig.
Waarom dit het antwoord is
Pig Latin met Pig is ideaal voor ETL-pijplijnen die checkpointing en pijplijn-splitsing vereisen. Pig's hoge-niveau taal maakt het eenvoudig om complexe datatransformaties uit te drukken, en het ondersteunt checkpointing door tussenresultaten op te slaan, wat cruciaal is voor fouttolerantie en herstel bij lange ETL-processen. Pijplijn-splitsing is inherent aan Pig's datastroommodel, waardoor data naar meerdere paden kan worden gestuurd voor verschillende transformaties. HiveQL met Hive is meer gericht op datawarehousing en ad-hoc query's, minder op complexe procedurele ETL-logica. Java met MapReduce en Python met MapReduce bieden weliswaar flexibiliteit, maar vereisen meer code voor dezelfde functionaliteit en missen de ingebouwde checkpointing en splitsingsmogelijkheden op hoog niveau die Pig biedt.
Slaag voor je examen — zonder eindeloos zoeken naar antwoorden
Krijg elke geverifieerde vraag en uitleg voor dit examen op één plek, en bespaar uren voorbereiding. Meer dan 1.000 certificeringen · Meer dan 20 talen · gratis om te beginnen.
Slaag sneller voor je examen → Geen kaart nodig