Un'azienda utilizza Amazon S3 come data lake e un cluster Amazon Redshift multi-nodo come data warehouse. I file di dati nel lake sono organizzati in base alla loro origine e l'azienda attualmente emette un comando COPY separato per ogni posizione di file da caricare in una singola tabella Redshift, il che è lento. L'azienda deve accelerare l'ingestione senza aumentare i costi. Cosa dovrebbe fare?
Scegli una risposta
Tocca un'opzione per controllare la tua risposta.
Risposta corretta: Creare un file manifest che contenga le posizioni dei file di dati. Utilizzare un comando COPY per caricare i dati in Amazon Redshift..
Perché questa è la risposta
La creazione di un file manifest è la soluzione più efficiente e conveniente. Un file manifest consente al comando COPY di Redshift di caricare più file da diverse posizioni S3 in un'unica operazione parallela, migliorando significativamente la velocità di ingestione senza costi aggiuntivi. Le altre opzioni introducono complessità o costi non necessari. L'uso di un cluster EMR o un job AWS Glue per consolidare i file in un'unica cartella prima del comando COPY aggiunge un passaggio intermedio e costi computazionali. Caricare i dati in Amazon Aurora e poi in Redshift è un processo indiretto e costoso, non adatto per l'ingestione diretta di data lake.
Supera il tuo esame — senza l'infinita caccia alle risposte
Ottieni ogni domanda e spiegazione verificata per questo esame in un unico posto, e risparmia ore di preparazione. Oltre 1.000 certificazioni · Oltre 20 lingue · Inizia gratuitamente.
Supera il tuo esame più velocemente → Nessuna carta richiesta