Bir IoT cihaz filosu, verileri kalıcı bir Amazon EMR kümesindeki HDFS'ye ORC dosyaları olarak yazar. Analistler, aynı EMR kümesinde Apache Presto ile SQL sorguları çalıştırır. Sorgular büyük hacimleri tarar, her zaman 15 dakikadan kısa sürede tamamlanır ve yalnızca akşam 5 ile akşam 10 arasında çalışır. Şirket, hala SQL sorgulamasına izin veren daha uygun maliyetli bir çözüm istiyor. Hangi çözüm en uygun maliyetlidir ve gereksinimleri karşılar?
Bir cevap seçin
Cevabınızı kontrol etmek için bir seçeneğe dokunun.
Doğru cevap: Verileri Amazon S3'te depolayın, AWS Glue Data Catalog'u kullanın ve Amazon Athena ile sorgulayın..
Neden bu cevap
Doğru cevap, verileri Amazon S3'te depolamak, AWS Glue Data Catalog'u kullanmak ve Amazon Athena ile sorgulamaktır. Bu çözüm, kalıcı bir EMR kümesini çalıştırma maliyetinden kaçınarak en uygun maliyetli yaklaşımı sunar. Athena, sunucusuzdur ve yalnızca çalıştırılan sorgular için ödeme yapılır, bu da yalnızca belirli saatlerde çalışan iş yükleri için idealdir. AWS Glue Data Catalog, şemayı yönetir ve Athena'nın S3'teki ORC dosyalarını sorgulamasını sağlar. Diğer seçenekler daha az maliyet etkilidir: Amazon Redshift Spectrum, S3'teki verileri sorgulayabilir ancak bir Redshift kümesinin çalışır durumda olmasını gerektirir, bu da sürekli maliyet anlamına gelir. EMRFS'de verileri tutmaya ve EMR üzerinde Presto kullanmaya devam etmek, kalıcı EMR kümesinin maliyetini sürdürür ve bu nedenle maliyet etkin değildir. Verileri Amazon Redshift'e yüklemek, verilerin Redshift'e taşınmasını gerektirir ve Redshift kümesinin sürekli çalışır durumda olma maliyetini doğurur.
Sonsuz cevap arayışı olmadan sınavınızı geçin
Bu sınav için her doğrulanmış soruyu ve açıklamayı tek bir yerde edinin ve saatlerce süren hazırlıktan tasarruf edin. 1.000'den fazla sertifika · 20'den fazla dil · ücretsiz başlayın.
Sınavınızı daha hızlı geçin → Kart gerekmez