ある企業が、分類器をトレーニングするためにPDFから固有表現を抽出する必要があります。最短時間でそれらのエンティティを抽出し、保存するアプローチはどれですか?
解答を選択
オプションをタップして解答を確認してください。
正解: Amazon Comprehendを使用してエンティティを抽出します。出力をAmazon S3に保存します。.
これが解答である理由
Amazon Comprehendは、PDFなどのドキュメントから固有表現(人物、場所、組織など)を直接抽出できるマネージドサービスです。最短時間でエンティティを抽出し、S3に保存する要件に最も適しています。 Amazon SageMakerでオープンソースのOCRツールを実行する方法は、ツールの選定、デプロイ、管理が必要となり、最短時間という要件には合致しません。 Amazon Textractはドキュメントからテキストと構造を抽出しますが、固有表現の抽出にはAmazon Comprehendが必要です。「抽出されたコンテンツをテキストに変換する」という説明は、Textractの機能と重複しており不適切です。 Amazon TextractとAmazon A2Iは、Textractで抽出したテキストの人間によるレビューを可能にしますが、固有表現の抽出自体はComprehendの機能であり、A2Iはレビュープロセスを追加するため、最短時間という要件には合いません。
試験に合格 — 終わりのない解答探しなしで
この試験のすべての検証済み問題と解説を1か所で入手し、準備時間を大幅に節約しましょう。1,000以上の認定 · 20以上の言語 · 無料で開始。
試験に早く合格する → カード不要