Un'azienda sta costruendo una piattaforma di analisi con Amazon S3 come data lake e Amazon Redshift come data warehouse. L'azienda intende utilizzare Amazon Redshift Spectrum per interrogare i dati di S3. Quali azioni PRODURRANNO le prestazioni di query PIÙ VELOCI? (Selezionare due.)
Scegli una risposta
Tocca un'opzione per controllare la tua risposta.
Risposta corretta: Utilizzare un formato di file di archiviazione colonnare., Partizionare i dati in base ai predicati di query più comuni..
Perché questa è la risposta
Per ottenere le prestazioni di query più veloci con Redshift Spectrum, è fondamentale ottimizzare il modo in cui i dati sono archiviati in S3. L'utilizzo di un formato di file di archiviazione colonnare (come Parquet o ORC) è essenziale perché consente a Redshift Spectrum di leggere solo le colonne necessarie per una query, riducendo significativamente la quantità di dati scansionati. La partizione dei dati in base ai predicati di query più comuni (ad esempio, per data o regione) permette a Redshift Spectrum di eliminare intere partizioni non pertinenti, limitando ulteriormente la quantità di dati da elaborare. Comprimere file molto grandi (1-5 GB) con gzip può rallentare l'elaborazione, poiché i file compressi devono essere decompressi completamente prima di essere letti. Dividere i dati in file molto piccoli (sotto i 10 KB) aumenta l'overhead di gestione e apertura dei file. L'uso di formati non suddivisibili impedisce l'elaborazione parallela, limitando le prestazioni.
Supera il tuo esame — senza l'infinita caccia alle risposte
Ottieni ogni domanda e spiegazione verificata per questo esame in un unico posto, e risparmia ore di preparazione. Oltre 1.000 certificazioni · Oltre 20 lingue · Inizia gratuitamente.
Supera il tuo esame più velocemente → Nessuna carta richiesta