Un éditeur a créé une solution RAG pour permettre aux utilisateurs d'interagir avec du contenu publié quotidiennement et souhaite des mises à jour quasi en temps réel. Quelles étapes du pipeline RAG sont appropriées pour être exécutées en tant que processus de traitement par lots hors ligne ? (Choisissez deux.)
Choisissez une réponse
Appuyez sur une option pour vérifier votre réponse.
Bonne réponse : Générer des embeddings pour le contenu publié.
Pourquoi c'est la réponse
La génération d'embeddings pour le contenu publié est une tâche intensive qui peut être effectuée de manière asynchrone et planifiée, ce qui la rend idéale pour un traitement par lots hors ligne. Cela permet de maintenir l'index de recherche à jour sans impacter la latence des requêtes utilisateur. La construction de l'index de recherche est également une opération qui peut être effectuée par lots, car elle dépend des embeddings du contenu et n'a pas besoin d'être exécutée en temps réel pour chaque requête. Les autres options sont des étapes qui doivent être exécutées en temps réel lors de la réception d'une requête utilisateur. La génération d'embeddings pour les requêtes utilisateur, la récupération de documents pertinents et la génération de la réponse finale sont toutes des opérations critiques pour la latence de la réponse du système RAG.
Réussissez votre examen — sans la chasse aux réponses interminable
Obtenez toutes les questions et explications vérifiées pour cet examen en un seul endroit, et économisez des heures de préparation. Plus de 1 000 certifications · Plus de 20 langues · Gratuit pour commencer.
Réussissez votre examen plus rapidement → Pas de carte requise