Un ingeniero de datos está cargando datos de clientes de terceros en Amazon Redshift. Un campo de origen contiene valores con formato JSON. Para cargar el JSON en el data warehouse con el menor esfuerzo, ¿qué debe hacer el ingeniero?
Elige una respuesta
Toca una opción para verificar tu respuesta.
Respuesta correcta: Usar el tipo de datos SUPER para almacenar los datos en la tabla de Amazon Redshift..
Por qué esta es la respuesta
La opción correcta es usar el tipo de datos SUPER para almacenar los datos en la tabla de Amazon Redshift. El tipo de datos SUPER en Amazon Redshift está diseñado específicamente para almacenar datos semiestructurados, como JSON, directamente en una columna de tabla. Esto permite a los ingenieros de datos cargar datos JSON sin necesidad de aplanarlos previamente, lo que reduce significativamente el esfuerzo y la complejidad. Redshift proporciona funciones SQL como JSONEXTRACTPATHTEXT para consultar directamente los elementos dentro de los datos SUPER. Las otras opciones son incorrectas porque: Usar AWS Glue para aplanar los datos JSON e ingerirlos en la tabla de Amazon Redshift: Esto implica un paso adicional de procesamiento y transformación, lo que aumenta el esfuerzo en comparación con el uso directo del tipo SUPER. Usar Amazon S3 para almacenar los datos JSON. Usar Amazon Athena para consultar los datos: Esto no carga los datos en Redshift, sino que los consulta en S3, lo cual no cumple con el requisito de cargar los datos en el data warehouse de Redshift. Usar una función de AWS Lambda para aplanar los datos JSON. Almacenar los datos en Amazon S3: Similar a la opción de Glue, esto añade complejidad y no carga los datos directamente en Redshift de la manera más eficiente.
Aprueba tu examen — sin la interminable búsqueda de respuestas
Obtén todas las preguntas y explicaciones verificadas para este examen en un solo lugar, y ahorra horas de preparación. Más de 1,000 certificaciones · Más de 20 idiomas · Empieza gratis.
Aprueba tu examen más rápido → No se requiere tarjeta