Bir veri mühendisi, yapılandırılmış .csv dosyalarını (15 sütun) bir Amazon S3 veri gölüne yüklemelidir. Analistler, genellikle yalnızca bir veya iki sütuna başvuran ve nadiren dosyanın tamamını tarayan Amazon Athena sorguları çalıştırır. En uygun maliyetli yaklaşım hangisidir?
Bir cevap seçin
Cevabınızı kontrol etmek için bir seçeneğe dokunun.
Doğru cevap: Yapılandırılmış .csv veri kaynağından okumak için bir AWS Glue ayıklama, dönüştürme ve yükleme (ETL) işi oluşturun. İşi, veriyi Apache Parquet formatında veri gölüne yazacak şekilde yapılandırın..
Neden bu cevap
Doğru cevap, verileri Apache Parquet formatında yazmak için bir AWS Glue ETL işi oluşturmaktır. Parquet, sütun tabanlı bir depolama formatıdır ve Athena gibi analitik sorgular için optimize edilmiştir. Sütun tabanlı depolama, Athena'nın yalnızca sorgulanan sütunları okumasını sağlayarak veri tarama miktarını azaltır ve bu da maliyetleri düşürür. CSV formatında bırakmak, Athena'nın her sorguda tüm dosyayı taramasına neden olur, bu da daha yüksek maliyetlere yol açar. JSON da satır tabanlı bir formattır ve Parquet'in sağladığı performans ve maliyet avantajlarını sunmaz. Apache Avro, satır tabanlı bir formattır ve Parquet'in sunduğu sütun tabanlı optimizasyonları sağlamaz.
Sonsuz cevap arayışı olmadan sınavınızı geçin
Bu sınav için her doğrulanmış soruyu ve açıklamayı tek bir yerde edinin ve saatlerce süren hazırlıktan tasarruf edin. 1.000'den fazla sertifika · 20'den fazla dil · ücretsiz başlayın.
Sınavınızı daha hızlı geçin → Kart gerekmez