Le prétraitement Dataflow lit de nombreux journaux BigQuery ; les performances sont médiocres et les données augmentent rapidement. Quel changement améliore les performances de lecture ?
Choisissez une réponse
Appuyez sur une option pour vérifier votre réponse.
Bonne réponse : Utilisez une lecture .fromQuery (basée sur une requête) qui sélectionne uniquement les champs spécifiques nécessaires..
Pourquoi c'est la réponse
La lecture de journaux BigQuery avec de mauvaises performances et une croissance rapide des données indique un besoin d'optimisation. L'utilisation d'une lecture .fromQuery() qui sélectionne uniquement les champs spécifiques nécessaires est la solution la plus efficace. En ne récupérant que les colonnes indispensables, vous réduisez considérablement la quantité de données transférées de BigQuery vers Dataflow, ce qui améliore les performances de lecture et minimise les coûts. Spécifier explicitement l'objet TableReference est une bonne pratique mais n'optimise pas la quantité de données lues. L'utilisation de TableSchema et TableFieldSchema est pour la définition du schéma, pas pour l'optimisation des requêtes. Appliquer une transformation qui renvoie des objets TableRow est le comportement par défaut de la lecture BigQuery et ne résout pas le problème de la lecture excessive de données.
Réussissez votre examen — sans la chasse aux réponses interminable
Obtenez toutes les questions et explications vérifiées pour cet examen en un seul endroit, et économisez des heures de préparation. Plus de 1 000 certifications · Plus de 20 langues · Gratuit pour commencer.
Réussissez votre examen plus rapidement → Pas de carte requise