Un'azienda sta addestrando modelli in SageMaker utilizzando 200 TB di dati archiviati in S3. Il dataset è composto da molti file, ciascuno più grande di 200 MB. L'azienda desidera il tempo di elaborazione più rapido con il minimo sforzo di configurazione. Quale metodo di accesso ai dati dovrebbe utilizzare?
Scegli una risposta
Tocca un'opzione per controllare la tua risposta.
Risposta corretta: Utilizzare la modalità SageMaker FastFile per lo streaming dei file on demand da S3..
Perché questa è la risposta
La modalità SageMaker FastFile è la soluzione più efficiente per questo scenario. Consente lo streaming on-demand dei dati direttamente da S3 alle istanze di training, riducendo i tempi di avvio e lo spazio di archiviazione locale richiesto. È ottimizzata per dataset di grandi dimensioni con file di grandi dimensioni, come i 200 TB e i file 200 MB menzionati. Richiede uno sforzo minimo di configurazione poiché è una funzionalità integrata di SageMaker. La modalità SageMaker File (o File Mode) copia l'intero dataset sull'istanza di training prima dell'inizio dell'addestramento, il che sarebbe estremamente lento e costoso per 200 TB di dati. Amazon FSx for Lustre è un'ottima opzione per prestazioni elevate, ma richiede una configurazione aggiuntiva e la gestione del file system, aumentando lo sforzo operativo rispetto a FastFile. Amazon EFS non è l'ideale per carichi di lavoro di machine learning ad alte prestazioni a causa della sua latenza e throughput inferiori rispetto a FSx for Lustre o FastFile, e richiederebbe comunque una configurazione e gestione aggiuntive.
Supera il tuo esame — senza l'infinita caccia alle risposte
Ottieni ogni domanda e spiegazione verificata per questo esame in un unico posto, e risparmia ore di preparazione. Oltre 1.000 certificazioni · Oltre 20 lingue · Inizia gratuitamente.
Supera il tuo esame più velocemente → Nessuna carta richiesta