Een bedrijf migreert on-premises Hadoop-clusters naar Amazon EMR en moet een bestaande Apache Hive metastore verplaatsen naar een persistente, serverloze oplossing voor de datacatalogus. Welke aanpak is het meest kosteneffectief en voldoet aan de serverloze vereiste?
Kies een antwoord
Tik op een optie om je antwoord te controleren.
Correct antwoord: Configureer een Hive metastore in Amazon EMR. Migreer de bestaande on-premises Hive metastore naar Amazon EMR. Gebruik AWS Glue Data Catalog om de datacatalogus van het bedrijf op te slaan als een externe datacatalogus..
Waarom dit het antwoord is
De correcte optie is om de bestaande Hive metastore te migreren naar een externe Hive metastore die wordt gehost op Amazon EMR, en vervolgens AWS Glue Data Catalog te gebruiken als de persistente, serverloze datacatalogus. AWS Glue Data Catalog is een volledig beheerde, serverloze service die compatibel is met Apache Hive metastore en naadloos integreert met Amazon EMR. Dit is de meest kosteneffectieve en serverloze oplossing. De eerste optie is onjuist omdat AWS DMS niet wordt gebruikt om een Hive metastore naar S3 te migreren; S3 is geen relationele database en de Glue Data Catalog scant S3 voor data, niet voor metastore-informatie. De derde optie is onjuist omdat het gebruik van Amazon Aurora MySQL voor de datacatalogus weliswaar persistent is, maar niet serverloos in de context van een volledig beheerde catalogus zoals Glue Data Catalog. De vierde optie is onjuist omdat een nieuwe Hive metastore in EMR niet serverloos is en niet de meest kosteneffectieve oplossing voor een persistente catalogus buiten de levensduur van het EMR-cluster.
Slaag voor je examen — zonder eindeloos zoeken naar antwoorden
Krijg elke geverifieerde vraag en uitleg voor dit examen op één plek, en bespaar uren voorbereiding. Meer dan 1.000 certificeringen · Meer dan 20 talen · gratis om te beginnen.
Slaag sneller voor je examen → Geen kaart nodig