Un scientifique des données utilisera Amazon SageMaker Data Wrangler pour ingérer des données historiques S3 afin d'effectuer une analyse exploratoire des données (EDA) pour trouver des anomalies rares. Pour minimiser les ressources de calcul lors de l'EDA, quelle option d'importation le scientifique des données doit-il choisir ?
Choisissez une réponse
Appuyez sur une option pour vérifier votre réponse.
Bonne réponse : Importer les données en utilisant l'option First K, en sélectionnant K en fonction des connaissances du domaine..
Pourquoi c'est la réponse
Pour l'analyse exploratoire des données (EDA) visant à trouver des anomalies rares, l'option "First K" est la plus appropriée pour minimiser les ressources de calcul. En important les premières K lignes, le scientifique des données peut rapidement examiner un sous-ensemble des données pour identifier des tendances ou des anomalies sans avoir à traiter l'ensemble du jeu de données, ce qui est coûteux en ressources. La valeur de K doit être choisie en fonction des connaissances du domaine pour s'assurer que l'échantillon est suffisamment représentatif. L'option "None" importerait toutes les données, ce qui irait à l'encontre de l'objectif de minimisation des ressources. "Stratified" et "Randomized" sont utiles pour l'échantillonnage représentatif, mais pour la détection d'anomalies rares et la minimisation des ressources, un échantillon initial simple comme "First K" est plus efficace pour une première exploration.
Réussissez votre examen — sans la chasse aux réponses interminable
Obtenez toutes les questions et explications vérifiées pour cet examen en un seul endroit, et économisez des heures de préparation. Plus de 1 000 certifications · Plus de 20 langues · Gratuit pour commencer.
Réussissez votre examen plus rapidement → Pas de carte requise