sélectionnez DEUX : LexaLegal, une startup de technologie juridique, a besoin d'un détecteur d'entités personnalisées Amazon Comprehend pour identifier les noms de parties, les clauses légales et les références de statuts. Leur équipe d'étiquetage peut soit produire des documents annotés avec des étendues d'entités, soit organiser des listes d'identifiants de statuts connus. Quelles sont les deux approches de données d'entraînement qu'ils peuvent utiliser lors de la création d'un détecteur d'entités personnalisées Comprehend ?
Choisissez une réponse
Appuyez sur une option pour vérifier votre réponse.
Bonne réponse : Fournir des documents d'entraînement annotés qui marquent les étendues d'entités (texte étiqueté) au format attendu par Comprehend (annotations au niveau du document)., Fournir une liste d'entités (un lexique) contenant des identifiants de statuts connus que Comprehend peut utiliser dans le cadre de l'entraînement..
Pourquoi c'est la réponse
La première approche correcte est de fournir des documents d'entraînement annotés. Amazon Comprehend Custom Entity Recognition prend en charge l'entraînement avec des documents où les étendues d'entités (par exemple, noms de parties, clauses légales) sont explicitement étiquetées. C'est la méthode standard pour enseigner au modèle à identifier des entités spécifiques dans un contexte. La deuxième approche correcte est de fournir une liste d'entités (un lexique). Comprehend permet d'utiliser un fichier de lexique (ou liste d'entités) contenant des termes connus (comme des identifiants de statuts) pour aider le modèle à reconnaître ces entités spécifiques. Cela est particulièrement utile pour les entités qui ont des formes fixes et connues. Les autres options sont incorrectes car : Télécharger un fichier CSV de balises d'objets S3 n'est pas une méthode d'entraînement directe pour les entités personnalisées dans Comprehend. Envoyer des PDF bruts à Textract ne crée pas un manifeste d'entraînement annoté pour Comprehend ; Textract extrait le texte, mais l'annotation des entités reste nécessaire. S'entraîner uniquement avec les entités pré-entraînées de Comprehend ne permet pas de détecter des entités personnalisées spécifiques à LexaLegal.
Réussissez votre examen — sans la chasse aux réponses interminable
Obtenez toutes les questions et explications vérifiées pour cet examen en un seul endroit, et économisez des heures de préparation. Plus de 1 000 certifications · Plus de 20 langues · Gratuit pour commencer.
Réussissez votre examen plus rapidement → Pas de carte requise