Une entreprise entraîne des modèles dans SageMaker en utilisant 200 To de données stockées dans S3. L'ensemble de données est composé de nombreux fichiers, chacun d'une taille supérieure à 200 Mo. L'entreprise souhaite le temps de traitement le plus rapide avec un effort de configuration minimal. Quelle méthode d'accès aux données devrait-elle utiliser ?
Choisissez une réponse
Appuyez sur une option pour vérifier votre réponse.
Bonne réponse : Utiliser le mode FastFile de SageMaker pour diffuser les fichiers à la demande depuis S3..
Pourquoi c'est la réponse
Le mode FastFile de SageMaker est la solution optimale car il est conçu pour diffuser des fichiers volumineux directement depuis S3 vers les instances d'entraînement à la demande, minimisant ainsi le temps de configuration et offrant des performances élevées pour les grands ensembles de données. Le mode Fichier de SageMaker copie l'intégralité de l'ensemble de données sur le stockage de l'instance, ce qui serait lent et coûteux pour 200 To. Amazon FSx for Lustre est une option performante, mais sa configuration est plus complexe que FastFile et n'est pas nécessaire ici car FastFile offre une solution intégrée et optimisée pour S3. Amazon EFS n'est pas adapté aux charges de travail de ML à grande échelle en raison de ses performances d'E/S inférieures comparées à FastFile ou FSx for Lustre.
Réussissez votre examen — sans la chasse aux réponses interminable
Obtenez toutes les questions et explications vérifiées pour cet examen en un seul endroit, et économisez des heures de préparation. Plus de 1 000 certifications · Plus de 20 langues · Gratuit pour commencer.
Réussissez votre examen plus rapidement → Pas de carte requise