Bir şirket, S3'te müşteri verilerini içeren günlük yaklaşık 2 GB boyutunda bir .xls dosyası alıyor. Bir veri mühendisi, ad ve soyadı sütunlarını birleştiriyor ve dosyadaki farklı müşteri sayısını sayması gerekiyor. Hangi yaklaşım en az operasyonel çaba gerektirir?
Bir cevap seçin
Cevabınızı kontrol etmek için bir seçeneğe dokunun.
Doğru cevap: Farklı müşteri sayısını hesaplamak için COUNT_DISTINCT toplama işlevini kullanan bir tarif oluşturmak için AWS Glue DataBrew'u kullanın..
Neden bu cevap
AWS Glue DataBrew, kod yazmaya gerek kalmadan verileri görsel olarak hazırlamak ve dönüştürmek için tasarlanmış, sunucusuz bir hizmettir. COUNTDISTINCT gibi yerleşik dönüşümleri ve toplama işlevlerini kullanarak veri hazırlama görevlerini basitleştirir. Bu, operasyonel çabayı en aza indirir çünkü altyapı yönetimi veya karmaşık kodlama gerektirmez. Diğer seçenekler (Glue not defteri, EMR Serverless, Athena), Spark veya SQL bilgisi gerektiren daha fazla kodlama veya altyapı yönetimi gerektirir, bu da daha fazla operasyonel çaba anlamına gelir. Glue crawler ve Athena kombinasyonu verileri sorgulamak için iyi olsa da, DataBrew'un görsel arayüzü ve yerleşik dönüşümleri bu özel görev için daha az çaba gerektirir.
Sonsuz cevap arayışı olmadan sınavınızı geçin
Bu sınav için her doğrulanmış soruyu ve açıklamayı tek bir yerde edinin ve saatlerce süren hazırlıktan tasarruf edin. 1.000'den fazla sertifika · 20'den fazla dil · ücretsiz başlayın.
Sınavınızı daha hızlı geçin → Kart gerekmez