Vous avez téléchargé 5 ans de journaux dans Cloud Storage et avez trouvé des valeurs hors limites indiquant des erreurs. Vous devez corriger les valeurs, conserver les originaux pour la conformité et pouvoir relancer le processus. Que devriez-vous faire ?
Choisissez une réponse
Appuyez sur une option pour vérifier votre réponse.
Bonne réponse : Créer un pipeline Dataflow qui lit à partir de Cloud Storage, remplace les valeurs hors limites par des valeurs par défaut appropriées et écrit les enregistrements corrigés dans un nouvel ensemble de données dans Cloud Storage..
Pourquoi c'est la réponse
La bonne approche est de créer un pipeline Dataflow qui lit les données de Cloud Storage, corrige les valeurs hors limites, puis écrit les enregistrements corrigés dans un nouvel ensemble de données dans Cloud Storage. Dataflow est idéal pour le traitement par lots de grands volumes de données, permettant une transformation efficace et la correction des erreurs. Écrire dans un nouvel ensemble de données garantit que les journaux originaux sont conservés pour la conformité et permet de relancer le processus si nécessaire sans altérer les données source. Importer les données dans BigQuery et ignorer les lignes avec des erreurs ne corrige pas les données et entraîne une perte d'informations. Créer une instance Compute Engine pour copier et ignorer des lignes est moins efficace et moins évolutif que Dataflow pour cette tâche. Écrire les enregistrements corrigés dans le même ensemble de données dans Cloud Storage écraserait les données originales, violant l'exigence de conformité de conservation des originaux et empêchant une relance propre.
Réussissez votre examen — sans la chasse aux réponses interminable
Obtenez toutes les questions et explications vérifiées pour cet examen en un seul endroit, et économisez des heures de préparation. Plus de 1 000 certifications · Plus de 20 langues · Gratuit pour commencer.
Réussissez votre examen plus rapidement → Pas de carte requise