분류기를 훈련시키기 위해 PDF에서 명명된 엔터티를 추출해야 하는 비즈니스가 있습니다. 어떤 접근 방식이 가장 짧은 시간 내에 해당 엔터티를 추출하고 저장할까요?
정답 선택
옵션을 탭하여 정답을 확인하세요.
정답: Amazon Comprehend를 사용하여 엔터티를 추출합니다. 출력을 Amazon S3에 저장합니다..
이것이 정답인 이유
가장 짧은 시간 내에 명명된 엔터티를 추출하고 저장하는 데 가장 효율적인 방법은 Amazon Comprehend를 사용하는 것입니다. Amazon Comprehend는 텍스트에서 명명된 엔터티를 직접 식별하고 추출하는 관리형 서비스입니다. PDF는 일반적으로 텍스트 기반이므로 Comprehend가 바로 처리할 수 있습니다. 추출된 엔터티는 Amazon S3에 쉽게 저장할 수 있습니다. 다른 옵션들은 다음과 같은 이유로 효율성이 떨어집니다. Amazon SageMaker에서 오픈 소스 OCR 도구를 실행하는 것은 설정 및 관리에 더 많은 시간이 소요됩니다. Amazon Textract는 PDF에서 텍스트를 추출하는 데 사용되지만, 명명된 엔터티를 식별하는 기능은 없습니다. Textract로 추출한 후 Comprehend를 사용하여 엔터티를 추출해야 하므로 두 단계가 필요합니다. Amazon Textract와 Amazon Augmented AI (A2I)를 사용하는 것은 사람이 검토하는 단계가 포함되어 시간이 더 오래 걸립니다.
끝없는 정답 찾기 없이 시험 합격
이 시험에 대한 모든 검증된 문제와 설명을 한곳에서 얻고, 준비 시간을 몇 시간 절약하세요. 1,000개 이상의 자격증 · 20개 이상의 언어 · 무료로 시작.
더 빠르게 시험 합격 → 카드 필요 없음