某公司每天處理數百份列印的 PDF 和 JPG 文件,需要一個自動化、低維護的工作流程來提取特定文字欄位並對文件進行分類。哪種解決方案所需的操作工作量最少?
選擇一個答案
點擊一個選項來檢查您的答案。
正確答案: 使用 Amazon Textract 提取欄位,並使用 Amazon Comprehend 來分類文件。.
為什麼這是答案
正確答案是使用 Amazon Textract 提取欄位,並使用 Amazon Comprehend 來分類文件。這是因為 Amazon Textract 專為從掃描文件(包括 PDF 和 JPG)中自動提取文字、手寫內容和資料而設計,無需手動配置或訓練模型,符合「低維護」和「自動化」的要求。Amazon Comprehend 則是一種自然語言處理 (NLP) 服務,可以分析文字並識別實體、關鍵詞、語言和情感,並能進行自訂分類,非常適合文件分類任務。 選項 A 和 B 涉及在 SageMaker 中執行 PaddleOCR 模型。雖然 PaddleOCR 是一個強大的 OCR 工具,但在 SageMaker 中部署和維護自訂模型需要較高的操作工作量,與「低維護」的要求不符。 選項 C 建議使用 Amazon Rekognition 進行文件分類。Amazon Rekognition 主要用於圖像和影片分析,例如物件偵測和人臉識別,而非基於文字內容的文件分類,因此不適用於此情境。
通過考試 — 無需無休止地尋找答案
集中一處獲取此考試的所有核實題目和解釋,節省數小時的準備時間。1,000 多種認證 · 20 多種語言 · 免費開始。
更快通過您的考試 → 無需信用卡