Un'azienda possiede un ampio set di dati non strutturati contenente molti record duplicati tra attributi chiave. Quale soluzione AWS identificherà i duplicati con la minima quantità di codice personalizzato?
Scegli una risposta
Tocca un'opzione per controllare la tua risposta.
Risposta corretta: Utilizzare la trasformazione AWS Glue FindMatches per identificare i record duplicati..
Perché questa è la risposta
La trasformazione AWS Glue FindMatches è la soluzione più efficiente per identificare record duplicati in set di dati non strutturati con il minimo codice personalizzato. Utilizza il machine learning per raggruppare record simili che potrebbero non essere corrispondenze esatte, ideale per dati con lievi variazioni. Creare attività Amazon Mechanical Turk richiederebbe un intervento umano significativo e non è automatizzato. Amazon QuickSight ML Insights è progettato per l'analisi e la visualizzazione, non per la deduplicazione su larga scala. Amazon SageMaker Data Wrangler è uno strumento di preparazione dati che può aiutare a pulire i dati, ma la sua funzionalità di rilevamento duplicati non è così specializzata o automatizzata come FindMatches per questo specifico caso d'uso.
Supera il tuo esame — senza l'infinita caccia alle risposte
Ottieni ogni domanda e spiegazione verificata per questo esame in un unico posto, e risparmia ore di preparazione. Oltre 1.000 certificazioni · Oltre 20 lingue · Inizia gratuitamente.
Supera il tuo esame più velocemente → Nessuna carta richiesta