Een bedrijf moet benoemde entiteiten uit een PDF halen om een classifier te trainen. Welke aanpak zal die entiteiten extraheren en opslaan in de KORTST MOGELIJKE tijd?
Kies een antwoord
Tik op een optie om je antwoord te controleren.
Correct antwoord: Gebruik Amazon Comprehend om de entiteiten te extraheren. Sla de uitvoer op in Amazon S3..
Waarom dit het antwoord is
De snelste aanpak is om Amazon Comprehend te gebruiken. Comprehend is een volledig beheerde Natural Language Processing (NLP)-dienst die Named Entity Recognition (NER) biedt en rechtstreeks entiteiten uit tekst kan extraheren. Aangezien de vraag specifiek vraagt om de KORTST MOGELIJKE tijd, is het gebruik van een directe NLP-dienst de meest efficiënte methode. Het uitvoeren van een open-source OCR-tool op SageMaker zou meer configuratie en beheer vereisen, wat langer duurt. Amazon Textract is primair voor het extraheren van tekst en gegevens uit documenten, niet voor NER. Hoewel het tekst kan extraheren, zou het nog steeds een aparte stap vereisen om entiteiten te identificeren, wat niet de meest directe route is. De combinatie van Textract en Comprehend zou twee stappen vereisen, wat langer duurt dan alleen Comprehend. Het gebruik van A2I met Textract voegt menselijke beoordeling toe, wat de verwerkingstijd aanzienlijk verlengt.
Slaag voor je examen — zonder eindeloos zoeken naar antwoorden
Krijg elke geverifieerde vraag en uitleg voor dit examen op één plek, en bespaar uren voorbereiding. Meer dan 1.000 certificeringen · Meer dan 20 talen · gratis om te beginnen.
Slaag sneller voor je examen → Geen kaart nodig