Une entreprise construit une plateforme d'analyse avec Amazon S3 comme lac de données et Amazon Redshift comme entrepôt de données. L'entreprise a l'intention d'utiliser Amazon Redshift Spectrum pour interroger les données S3. Quelles actions produiront les performances de requête les PLUS RAPIDES ? (Sélectionnez deux.)
Choisissez une réponse
Appuyez sur une option pour vérifier votre réponse.
Bonne réponse : Utiliser un format de fichier de stockage en colonnes., Partitionner les données en fonction des prédicats de requête les plus courants..
Pourquoi c'est la réponse
Pour des performances optimales avec Redshift Spectrum, l'utilisation d'un format de fichier de stockage en colonnes (comme Parquet ou ORC) est cruciale. Ces formats permettent à Redshift Spectrum de ne lire que les colonnes nécessaires à la requête, réduisant considérablement la quantité de données scannées. La partition des données en fonction des prédicats de requête les plus courants (par exemple, par date ou par région) permet à Redshift Spectrum d'éliminer des partitions entières, ne scannant qu'un sous-ensemble pertinent des données. Compresser des fichiers individuels entre 1 Go et 5 Go avec gzip est une bonne pratique, mais les formats de fichiers en colonnes sont plus efficaces pour les requêtes ciblées. Diviser les données en fichiers de moins de 10 Ko génère trop de surcharge et dégrade les performances. Utiliser des formats de fichiers non scindables empêche le traitement parallèle et réduit l'efficacité des requêtes.
Réussissez votre examen — sans la chasse aux réponses interminable
Obtenez toutes les questions et explications vérifiées pour cet examen en un seul endroit, et économisez des heures de préparation. Plus de 1 000 certifications · Plus de 20 langues · Gratuit pour commencer.
Réussissez votre examen plus rapidement → Pas de carte requise