Bir veri mühendisinin, bir S3 bucket'ındaki Apache Parquet nesnelerini okumak ve yalnızca tek bir sütunu çıkarmak için tek seferlik bir ihtiyacı vardır. Bu, minimum operasyonel yük ile hangi seçenekle başarılabilir?
Bir cevap seçin
Cevabınızı kontrol etmek için bir seçeneğe dokunun.
Doğru cevap: S3 nesnelerinden gerekli sütunu almak için bir SQL SELECT ifadesi yazmak üzere S3 Select'i kullanın..
Neden bu cevap
S3 Select, S3 nesnelerinden belirli verileri doğrudan SQL ifadeleri kullanarak almanızı sağlar. Bu, tüm nesneyi indirip işlemek yerine yalnızca ihtiyacınız olan veriyi çektiği için minimum operasyonel yük ve maliyet sunar. Tek seferlik ihtiyaçlar için idealdir. Diğer seçenekler neden uygun değil: AWS Lambda fonksiyonu ve Pandas: Tüm veriyi indirip belleğe yükleyeceği için büyük dosyalarda verimsiz ve maliyetli olabilir. Ayrıca Lambda'nın yapılandırılması ve yönetimi ek operasyonel yük getirir. AWS Glue DataBrew: Veri hazırlama ve temizleme için tasarlanmış yönetilen bir hizmettir, tek bir sütunu çıkarmak gibi basit bir işlem için aşırıya kaçar ve daha fazla kurulum gerektirir. AWS Glue Crawler ve Athena: Athena güçlü bir sorgulama aracı olsa da, bir Glue Crawler çalıştırmak ve bir Glue Data Catalog tablosu oluşturmak, tek seferlik bir sütun çıkarma işlemi için gereksiz operasyonel yük ve zaman maliyeti getirir.
Sonsuz cevap arayışı olmadan sınavınızı geçin
Bu sınav için her doğrulanmış soruyu ve açıklamayı tek bir yerde edinin ve saatlerce süren hazırlıktan tasarruf edin. 1.000'den fazla sertifika · 20'den fazla dil · ücretsiz başlayın.
Sınavınızı daha hızlı geçin → Kart gerekmez