Un team di data science archivierà molti set di dati di training diversi e deve supportare il dimensionamento automatico, l'efficienza dei costi e l'esplorazione basata su SQL. Qual è l'approccio di archiviazione più adatto a questo caso d'uso?
Scegli una risposta
Tocca un'opzione per controllare la tua risposta.
Risposta corretta: Salvare i set di dati come file in Amazon S3..
Perché questa è la risposta
Amazon S3 è la soluzione di archiviazione più adatta perché offre scalabilità automatica, efficienza dei costi (paghi solo per ciò che usi) e supporta l'esplorazione basata su SQL tramite servizi come Amazon Athena, che può interrogare i dati direttamente in S3. Archiviare i set di dati come file su un volume Amazon EBS non è scalabile o conveniente per grandi volumi di dati e richiede la gestione dell'infrastruttura. Mantenere i set di dati in un cluster Amazon Redshift è costoso e sovradimensionato per la semplice archiviazione di file, essendo più adatto per il data warehousing analitico. Archiviare i set di dati come tabelle globali in Amazon DynamoDB è ottimizzato per carichi di lavoro NoSQL ad alte prestazioni e non è ideale per l'archiviazione di file o l'esplorazione SQL di grandi set di dati non strutturati.
Supera il tuo esame — senza l'infinita caccia alle risposte
Ottieni ogni domanda e spiegazione verificata per questo esame in un unico posto, e risparmia ore di preparazione. Oltre 1.000 certificazioni · Oltre 20 lingue · Inizia gratuitamente.
Supera il tuo esame più velocemente → Nessuna carta richiesta