Bir veri mühendisi, hem .csv hem de .json dosyaları içeren bir S3 bucket'ındaki verileri kataloglamak için bir AWS Glue crawler yapılandırdı. Crawler, .json dosyalarını hariç tutacak şekilde ayarlanmıştı, ancak Athena sorguları çalıştırıldığında .json dosyaları hala işleniyor. Mühendisin, .csv dosyalarına erişimi değiştirmeden bu durumu düzeltmesi ve mümkün olan en kısa sorgu sürelerini elde etmesi gerekiyor. En iyi çözüm nedir?
Bir cevap seçin
Cevabınızı kontrol etmek için bir seçeneğe dokunun.
Doğru cevap: .json dosyalarını S3 bucket'ı içinde farklı bir yola taşıyın..
Neden bu cevap
AWS Glue crawler'ın hariç tutma ayarları, yalnızca crawler'ın Glue Data Catalog'a hangi tabloları ekleyeceğini kontrol eder. Athena, Data Catalog'daki mevcut tüm tabloları sorgulayabilir. Bu nedenle, crawler ayarlarını değiştirmek veya Athena konsolundan hariç tutma yapmak, .json dosyalarının sorgulanmasını engellemez. S3 bucket politikaları ise erişimi kısıtlar, ancak bu, sorgu sürelerini optimize etmekten ziyade güvenlik odaklı bir çözümdür ve .csv dosyalarına erişimi de etkileyebilir. .json dosyalarını farklı bir S3 yoluna taşımak, Athena'nın yalnızca .csv dosyalarını içeren yolu taramasını sağlayarak sorgu sürelerini kısaltır ve .csv dosyalarına erişimi etkilemez.
Sonsuz cevap arayışı olmadan sınavınızı geçin
Bu sınav için her doğrulanmış soruyu ve açıklamayı tek bir yerde edinin ve saatlerce süren hazırlıktan tasarruf edin. 1.000'den fazla sertifika · 20'den fazla dil · ücretsiz başlayın.
Sınavınızı daha hızlı geçin → Kart gerekmez