Een bedrijf laadt honderden bestanden in een feitentabel in een Amazon Redshift-cluster en wil de hoogst mogelijke laaddoorvoer bereiken, terwijl de clusterbronnen efficiënt worden gebruikt. Welke laadstrategie voldoet het beste aan deze doelen?
Kies een antwoord
Tik op een optie om je antwoord te controleren.
Correct antwoord: Gebruik één enkele COPY command om de gegevens in het Redshift-cluster te laden..
Waarom dit het antwoord is
De COPY-opdracht is de meest efficiënte manier om grote hoeveelheden gegevens in Amazon Redshift te laden. Redshift is ontworpen om parallel te werken en de COPY-opdracht maakt optimaal gebruik van de parallelle verwerkingsarchitectuur van het cluster. Door één enkele COPY-opdracht te gebruiken, kan Redshift de gegevens automatisch verdelen over de compute nodes en deze parallel laden, wat resulteert in de hoogst mogelijke doorvoer. Meerdere COPY-opdrachten kunnen leiden tot resourceconflicten en overhead, waardoor de totale laadtijd toeneemt. S3DistCp is bedoeld voor het kopiëren van gegevens tussen S3 en HDFS, niet voor het laden in Redshift. INSERT-statements zijn transactioneel en veel minder efficiënt voor bulkloads dan de COPY-opdracht, vooral bij grote datasets.
Slaag voor je examen — zonder eindeloos zoeken naar antwoorden
Krijg elke geverifieerde vraag en uitleg voor dit examen op één plek, en bespaar uren voorbereiding. Meer dan 1.000 certificeringen · Meer dan 20 talen · gratis om te beginnen.
Slaag sneller voor je examen → Geen kaart nodig