Un'azienda sta caricando centinaia di file in una tabella dei fatti in un cluster Amazon Redshift e desidera la massima velocità di caricamento possibile utilizzando le risorse del cluster in modo efficiente. Quale strategia di caricamento soddisferà al meglio questi obiettivi?
Scegli una risposta
Tocca un'opzione per controllare la tua risposta.
Risposta corretta: Utilizzare un singolo comando COPY per caricare i dati nel cluster Redshift..
Perché questa è la risposta
Un singolo comando COPY è il metodo più efficiente per caricare grandi quantità di dati in Amazon Redshift. Redshift è progettato per parallelizzare il caricamento dei dati da più file sorgente quando viene utilizzato un singolo comando COPY, distribuendo il lavoro tra i nodi di calcolo. Questo massimizza la velocità di caricamento e l'utilizzo delle risorse del cluster. L'uso di più comandi COPY introdurrebbe un sovraccarico di transazione e gestione, rallentando il processo. S3DistCp e un connettore HDFS sono soluzioni complesse e non native per Redshift, che aggiungerebbero passaggi e latenza non necessari. L'uso di istruzioni INSERT, anche se parallele, è significativamente meno efficiente del comando COPY per carichi di dati massivi, in quanto ogni INSERT è una singola operazione transazionale.
Supera il tuo esame — senza l'infinita caccia alle risposte
Ottieni ogni domanda e spiegazione verificata per questo esame in un unico posto, e risparmia ore di preparazione. Oltre 1.000 certificazioni · Oltre 20 lingue · Inizia gratuitamente.
Supera il tuo esame più velocemente → Nessuna carta richiesta