Bir perakende şirketi, günlük perakende sipariş CSV dosyalarını tek bir S3 yoluna yükler ve 100'den fazla sütunlu verinin alt kümelerini sorgulamak için Amazon Redshift Spectrum kullanır. Üçüncü taraf kaynak, günde 30'dan fazla CSV dosyası (her biri 50-70 MB) üretir. Kullanıcılar günlük metrikleri toplar, ancak sorgu performansı düşmüştür. En az geliştirme çabasıyla performans sorunlarını çözecek eylem kombinasyonu hangisidir? (İki tane seçin.)
Bir cevap seçin
Cevabınızı kontrol etmek için bir seçeneğe dokunun.
Doğru cevap: Üçüncü taraf uygulamayı dosyaları sütunlu bir formatta üretecek şekilde yapılandırın., Sipariş verilerini S3 bucket'ında sipariş tarihine göre bölümleyin..
Neden bu cevap
Redshift Spectrum, harici verileri sorgularken en iyi performansı sütunlu formatlarda (örneğin Parquet veya ORC) gösterir çünkü bu formatlar yalnızca sorgulanan sütunların okunmasına izin verir ve veri taramasını azaltır. Bu nedenle, üçüncü taraf uygulamayı dosyaları sütunlu bir formatta üretecek şekilde yapılandırmak performansı önemli ölçüde artıracaktır. Ayrıca, verileri sipariş tarihine göre bölümlemek, Redshift Spectrum'un yalnızca ilgili bölümlerdeki verileri taramasını sağlayarak sorgu performansını iyileştirir. CSV dosyalarını tek bir dosyada birleştirmek, dosya sayısını azaltır ancak formatın satır tabanlı doğası nedeniyle tarama miktarını değiştirmez. JSON formatı da satır tabanlıdır ve sütunlu formatlar kadar verimli değildir. SUPER tipi sütun, Redshift'in kendi içindeki bir özelliktir ve S3'teki harici veri formatını doğrudan etkilemez.
Sonsuz cevap arayışı olmadan sınavınızı geçin
Bu sınav için her doğrulanmış soruyu ve açıklamayı tek bir yerde edinin ve saatlerce süren hazırlıktan tasarruf edin. 1.000'den fazla sertifika · 20'den fazla dil · ücretsiz başlayın.
Sınavınızı daha hızlı geçin → Kart gerekmez