Bir veri bilimcinin, Amazon S3 veri gölünde CSV dosyaları olarak depolanan yaklaşık 500 GB'lık geçmiş envanter verisini keşfetmesi gerekiyor. Keşif için SQL kullanmak istiyorlar ve şirket maliyeti ve operasyonel yükü en aza indirmek istiyor. En az operasyonel yönetimle bu gereksinimleri hangi yaklaşım karşılar?
Bir cevap seçin
Cevabınızı kontrol etmek için bir seçeneğe dokunun.
Doğru cevap: S3 bucket'ını taramak ve AWS Glue Data Catalog'u doldurmak için AWS Glue kullanmak, ardından verileri Amazon Athena ile sorgulamak..
Neden bu cevap
Bu yaklaşım, sunucusuz yapısı sayesinde en düşük operasyonel yükü ve maliyeti sunar. AWS Glue, S3'teki CSV dosyalarını otomatik olarak tarar ve şemayı AWS Glue Data Catalog'a ekler. Amazon Athena ise bu katalogdaki verileri standart SQL kullanarak doğrudan S3 üzerinden sorgulamanıza olanak tanır, böylece herhangi bir altyapı yönetimi veya küme sağlama ihtiyacını ortadan kaldırır. Diğer seçenekler ise daha yüksek operasyonel yük ve maliyet gerektirir: Amazon EMR, küme yönetimi ve bakımını gerektirir. Amazon Redshift kümesi sağlamak ve yönetmek operasyonel maliyet ve yük getirir. Redshift Spectrum ile harici tablolar oluşturmak operasyonel yükü bir miktar azaltır ancak yine de bir Redshift kümesi yönetimi gerektirir.
Sonsuz cevap arayışı olmadan sınavınızı geçin
Bu sınav için her doğrulanmış soruyu ve açıklamayı tek bir yerde edinin ve saatlerce süren hazırlıktan tasarruf edin. 1.000'den fazla sertifika · 20'den fazla dil · ücretsiz başlayın.
Sınavınızı daha hızlı geçin → Kart gerekmez