Une entreprise souhaite utiliser un modèle d'IA générative pour fournir aux utilisateurs des devis de service en temps réel. Quel critère de sélection est le plus important pour cette application ?
Choisissez une réponse
Appuyez sur une option pour vérifier votre réponse.
Bonne réponse : Une faible latence et des performances d'inférence optimisées pour des réponses rapides.
Pourquoi c'est la réponse
Pour fournir des devis de service en temps réel, la rapidité de réponse est primordiale. Une faible latence et des performances d'inférence optimisées garantissent que le modèle peut traiter les requêtes et générer des devis instantanément, offrant ainsi une expérience utilisateur fluide et efficace. La taille globale du modèle est moins critique si la latence est élevée, car un modèle plus grand ne signifie pas nécessairement une réponse plus rapide. La qualité des données d'entraînement est importante pour la précision, mais si le modèle est lent, même des devis précis ne seront pas utiles en temps réel. Choisir un modèle à usage général et avoir accès à des GPU haute performance est une considération technique, mais la priorité reste la capacité à délivrer des réponses rapides, ce qui est directement lié à la faible latence et aux performances d'inférence.
Réussissez votre examen — sans la chasse aux réponses interminable
Obtenez toutes les questions et explications vérifiées pour cet examen en un seul endroit, et économisez des heures de préparation. Plus de 1 000 certifications · Plus de 20 langues · Gratuit pour commencer.
Réussissez votre examen plus rapidement → Pas de carte requise