Bir havayolu POC'si, günlük CSV metriklerini tarihe göre bölümlenmiş S3'te depolar ve bunları Amazon Athena ile sorgular. Veriler büyüdükçe, şirket sorgu performansını artırmak için depolamayı optimize etmek istiyor. Hangi iki eylemi yapmalılar? (İki tane seçin.)
Bir cevap seçin
Cevabınızı kontrol etmek için bir seçeneğe dokunun.
Doğru cevap: Şirketin Athena sorgularını çalıştırdığı aynı AWS Bölgesi'nde bulunan bir S3 bucket'ı kullanın., Yalnızca predikatlar için gereken veri bloklarını getirerek .csv verilerini Apache Parquet formatına ön işleyin..
Neden bu cevap
Doğru cevaplar, sorgu performansını artırmak için en etkili yöntemleri sunar. Aynı AWS Bölgesi'nde bir S3 bucket'ı kullanmak, veri aktarım gecikmesini azaltır ve Athena'nın verilere daha hızlı erişmesini sağlar. Farklı bir bölgedeki bucket, ağ gecikmesi nedeniyle sorgu süresini uzatır. Verileri Apache Parquet formatına ön işlemek, sütun tabanlı depolama ve sıkıştırma avantajları sunar. Bu, Athena'nın yalnızca sorgunun gerektirdiği sütunları okumasını sağlayarak veri tarama miktarını önemli ölçüde azaltır ve performansı artırır. CSV verilerini JSON'a dönüştürmek, sütun tabanlı okuma avantajı sağlamaz ve genellikle daha fazla depolama alanı gerektirir. S3 anahtarlarının başına rastgele bir dize eklemek, S3'teki GET/PUT performansını artırabilir ancak Athena sorgu performansına doğrudan bir etkisi yoktur çünkü Athena, bölüm anahtarlarını kullanarak verileri filtreler.
Sonsuz cevap arayışı olmadan sınavınızı geçin
Bu sınav için her doğrulanmış soruyu ve açıklamayı tek bir yerde edinin ve saatlerce süren hazırlıktan tasarruf edin. 1.000'den fazla sertifika · 20'den fazla dil · ücretsiz başlayın.
Sınavınızı daha hızlı geçin → Kart gerekmez