Una empresa almacena registros diarios de rendimiento de cartera como archivos .csv en Amazon S3 y utiliza AWS Glue crawlers para catalogar los datos. Los datos deben estar disponibles en el AWS Glue Data Catalog todos los días. ¿Qué configuración cumple este requisito?
Elige una respuesta
Toca una opción para verificar tu respuesta.
Respuesta correcta: Cree un rol de IAM que incluya la política AWSGlueServiceRole. Adjunte el rol al crawler. Apunte el crawler a la ruta de origen de S3. Cree una programación diaria para ejecutar el crawler. Especifique un nombre de base de datos para la salida..
Por qué esta es la respuesta
La opción correcta describe los pasos esenciales para catalogar datos en AWS Glue. El rol AWSGlueServiceRole proporciona los permisos necesarios para que Glue acceda a S3 y escriba en el Data Catalog. Apuntar el crawler a la ruta de origen de S3 es fundamental para que Glue sepa dónde buscar los datos. Una programación diaria asegura que los registros de rendimiento se cataloguen a tiempo. Especificar un nombre de base de datos organiza los metadatos en el Data Catalog. Las opciones incorrectas presentan fallas: Usar AmazonS3FullAccess es un permiso excesivo y no incluye los permisos necesarios para Glue para escribir en el Data Catalog. Además, escribir la salida en una nueva ruta en S3 no es la función del crawler; su propósito es catalogar metadatos. Asignar DPUs (Data Processing Units) no es una configuración de programación, sino una medida de capacidad de procesamiento que se escala automáticamente. La última opción incorrecta también confunde la asignación de DPUs con la programación y, nuevamente, la salida del crawler es el Data Catalog, no una nueva ruta en S3.
Aprueba tu examen — sin la interminable búsqueda de respuestas
Obtén todas las preguntas y explicaciones verificadas para este examen en un solo lugar, y ahorra horas de preparación. Más de 1,000 certificaciones · Más de 20 idiomas · Empieza gratis.
Aprueba tu examen más rápido → No se requiere tarjeta