Vous écrivez des événements de comportement utilisateur dans BigQuery via l'API BigQuery Storage Write et devez empêcher les doublons en utilisant l'approche opérationnelle la plus simple. Que faites-vous ?
Choisissez une réponse
Appuyez sur une option pour vérifier votre réponse.
Bonne réponse : Créer un flux d'écriture de type « committed »..
Pourquoi c'est la réponse
Pour empêcher les doublons de la manière la plus simple avec l'API BigQuery Storage Write, vous devez créer un flux d'écriture de type « committed ». Ce type de flux garantit l'atomicité et la déduplication au niveau de la ligne en utilisant un identifiant unique pour chaque enregistrement, ce qui est idéal pour les cas d'utilisation où les données peuvent être envoyées plusieurs fois mais ne doivent être écrites qu'une seule fois. Un flux d'écriture de type par défaut (default) n'offre pas de garanties de déduplication intégrées et pourrait entraîner des doublons si les données sont renvoyées. Configurer un cluster Kafka ou un sujet Pub/Sub avec Cloud Functions pour la déduplication est une approche beaucoup plus complexe et opérationnellement coûteuse, nécessitant une logique de déduplication personnalisée et une gestion d'infrastructure supplémentaire, ce qui contredit l'objectif de l'approche la plus simple.
Réussissez votre examen — sans la chasse aux réponses interminable
Obtenez toutes les questions et explications vérifiées pour cet examen en un seul endroit, et économisez des heures de préparation. Plus de 1 000 certifications · Plus de 20 langues · Gratuit pour commencer.
Réussissez votre examen plus rapidement → Pas de carte requise