Bir yatırım firması, sürekli büyüyen hacimde yarı yapılandırılmış veriyi alıyor ve kayıtları tekilleştirmesi, kopyaları ve yaygın yazım hatalarını gidermesi gerekiyor. Hangi seçenek, en az operasyonel yük ile bu yeteneği sağlar?
Bir cevap seçin
Cevabınızı kontrol etmek için bir seçeneğe dokunun.
Doğru cevap: Yinelenen kayıtları kaldırmak için AWS Glue'nun FindMatches özelliğini kullanın..
Neden bu cevap
Doğru cevap, AWS Glue'nun FindMatches özelliğini kullanmaktır. FindMatches, makine öğrenimi kullanarak yinelenen veya birbirine benzeyen kayıtları tanımlar ve birleştirir. Bu, yarı yapılandırılmış verilerdeki kopyaları ve yaygın yazım hatalarını gidermek için idealdir ve minimum operasyonel yükle yüksek doğruluk sağlar. Amazon Athena'da pencere fonksiyonları kullanmak, tam eşleşmeleri bulmak için etkili olabilir ancak yazım hataları veya hafif varyasyonlar içeren yarı yapılandırılmış verilerde yetersiz kalır. Amazon Neptune ML ve Apache Gremlin betiği, grafik veritabanları için tasarlanmıştır ve bu senaryo için aşırı karmaşık ve uygunsuz bir çözümdür. Amazon DynamoDB'nin global tables özelliği, veritabanı replikasyonu içindir ve yinelenen verileri önlemek veya mevcut kopyaları gidermek için tasarlanmamıştır.
Sonsuz cevap arayışı olmadan sınavınızı geçin
Bu sınav için her doğrulanmış soruyu ve açıklamayı tek bir yerde edinin ve saatlerce süren hazırlıktan tasarruf edin. 1.000'den fazla sertifika · 20'den fazla dil · ücretsiz başlayın.
Sınavınızı daha hızlı geçin → Kart gerekmez