Una empresa necesita una forma sin código de transformar un gran conjunto de datos Parquet en Amazon S3 aplicando codificación one-hot a algunas columnas y escribir los datos transformados de nuevo en el mismo bucket de S3. ¿Qué solución cumple con estas restricciones?
Elige una respuesta
Toca una opción para verificar tu respuesta.
Respuesta correcta: Crear un proyecto de AWS Glue DataBrew que se conecte a los datos de S3, crear una receta para codificar las columnas con one-hot y ejecutar un trabajo para escribir la salida de nuevo en S3..
Por qué esta es la respuesta
La opción correcta es AWS Glue DataBrew porque es una herramienta sin código diseñada para la preparación de datos, incluyendo transformaciones como la codificación one-hot. Permite conectarse directamente a S3, aplicar transformaciones mediante recetas y escribir los resultados de vuelta a S3, cumpliendo todos los requisitos. Las otras opciones son incorrectas porque: Amazon Athena SQL no tiene una función nativa y sencilla para realizar codificación one-hot directamente en SQL sin código adicional o UDFs complejos, y no es una herramienta sin código para transformaciones complejas. Un notebook interactivo de AWS Glue ETL requiere escribir código (Python o Scala), lo que contradice el requisito "sin código". Amazon Redshift con Redshift Spectrum también implicaría escribir SQL complejo para la codificación one-hot y aprovisionar un clúster, lo cual es más pesado que DataBrew para esta tarea de preparación de datos sin código.
Aprueba tu examen — sin la interminable búsqueda de respuestas
Obtén todas las preguntas y explicaciones verificadas para este examen en un solo lugar, y ahorra horas de preparación. Más de 1,000 certificaciones · Más de 20 idiomas · Empieza gratis.
Aprueba tu examen más rápido → No se requiere tarjeta