Une entreprise charge des centaines de fichiers dans une table de faits d'un cluster Amazon Redshift et souhaite obtenir le débit de chargement le plus élevé possible tout en utilisant efficacement les ressources du cluster. Quelle stratégie de chargement répondra le mieux à ces objectifs ?
Choisissez une réponse
Appuyez sur une option pour vérifier votre réponse.
Bonne réponse : Utiliser une seule commande COPY pour charger les données dans le cluster Redshift..
Pourquoi c'est la réponse
La commande COPY est la méthode la plus efficace pour charger des données en masse dans Amazon Redshift. Elle distribue automatiquement le travail de chargement sur tous les nœuds de calcul du cluster, permettant un traitement parallèle et un débit élevé. L'utilisation d'une seule commande COPY pour plusieurs fichiers (en spécifiant un préfixe S3 ou un fichier manifeste) permet à Redshift d'optimiser le processus de chargement en interne. Utiliser plusieurs commandes COPY peut entraîner une surcharge due à l'initialisation répétée des transactions. S3DistCp et HDFS ne sont pas des outils natifs pour le chargement direct dans Redshift et introduiraient des étapes et des complexités inutiles. Les instructions INSERT sont conçues pour l'insertion de lignes individuelles et sont inefficaces pour les chargements massifs, même en parallèle, car elles ne bénéficient pas des optimisations de la commande COPY.
Réussissez votre examen — sans la chasse aux réponses interminable
Obtenez toutes les questions et explications vérifiées pour cet examen en un seul endroit, et économisez des heures de préparation. Plus de 1 000 certifications · Plus de 20 langues · Gratuit pour commencer.
Réussissez votre examen plus rapidement → Pas de carte requise