Uma empresa tem um grande conjunto de dados não estruturados contendo muitos registros duplicados em atributos-chave. Qual solução da AWS identificará duplicatas com a menor quantidade de codificação personalizada?
Escolha uma resposta
Toque em uma opção para verificar sua resposta.
Resposta correta: Usar a transformação AWS Glue FindMatches para identificar registros duplicados..
Por que esta é a resposta
A transformação AWS Glue FindMatches é a solução mais adequada porque foi projetada especificamente para identificar registros duplicados em conjuntos de dados, mesmo quando não há um identificador exato. Ela usa aprendizado de máquina para aprender padrões de correspondência, exigindo a menor quantidade de codificação personalizada para essa tarefa. Criar tarefas do Amazon Mechanical Turk envolveria trabalho manual e seria ineficiente para grandes volumes de dados. Usar o Amazon QuickSight ML Insights é para análise e visualização de dados, não para deduplicação em larga escala. O Amazon SageMaker Data Wrangler é uma ferramenta de preparação de dados que pode ajudar no pré-processamento, mas não oferece uma funcionalidade de detecção de duplicatas baseada em ML tão específica e automatizada quanto o AWS Glue FindMatches.
Passe no seu exame — sem a busca interminável por respostas
Obtenha todas as perguntas e explicações verificadas para este exame em um só lugar e economize horas de preparação. Mais de 1.000 certificações · Mais de 20 idiomas · Grátis para começar.
Passe no seu exame mais rápido → Não é necessário cartão