Firma musi wyodrębnić nazwane encje z pliku PDF, aby wytrenować klasyfikator. Które podejście wyodrębni te encje i zapisze je w NAJKRÓTSZYM czasie?
Wybierz odpowiedź
Dotknij opcji, aby sprawdzić swoją odpowiedź.
Poprawna odpowiedź: Użyj Amazon Comprehend do wyodrębnienia encji. Zapisz wynik w Amazon S3..
Dlaczego to jest odpowiedź
Amazon Comprehend to usługa przetwarzania języka naturalnego (NLP), która potrafi bezpośrednio wyodrębniać nazwane encje (NER) z tekstu. Jeśli plik PDF zawiera już tekst, Comprehend może go przetworzyć najszybciej, ponieważ nie wymaga dodatkowych kroków konwersji. Uruchomienie narzędzia OCR typu open source na SageMaker wymagałoby konfiguracji instancji i oprogramowania, co jest czasochłonne. Opcja z Amazon Textract, a następnie Amazon Comprehend do konwersji na tekst jest błędna, ponieważ Textract sam w sobie wyodrębnia tekst z dokumentów, a Comprehend nie służy do konwersji obrazu na tekst. Textract z A2I jest przydatny do weryfikacji ludzkiej, ale nie jest najszybszym rozwiązaniem do samego wyodrębniania encji, jeśli tekst jest już dostępny lub łatwo dostępny.
Zdaj egzamin — bez niekończącego się szukania odpowiedzi
Uzyskaj wszystkie zweryfikowane pytania i wyjaśnienia do tego egzaminu w jednym miejscu i zaoszczędź godziny przygotowań. Ponad 1000 certyfikacji · Ponad 20 języków · Zacznij za darmo.
Zdaj egzamin szybciej → Karta nie jest wymagana