Una empresa planea ejecutar trabajos de Apache Spark en un clúster de Amazon EMR aprovisionado para análisis de big data y requiere alta fiabilidad. El equipo de big data desea cargas de trabajo de larga duración optimizadas en cuanto a costes, manteniendo el rendimiento actual. ¿Qué combinación de opciones es la MÁS rentable? (Elija dos)
Elige una respuesta
Toca una opción para verificar tu respuesta.
Respuesta correcta: Usar Amazon S3 como almacén de datos persistente., Usar instancias Graviton para los nodos principales y los nodos de tareas..
Por qué esta es la respuesta
Amazon S3 es la opción más rentable para el almacenamiento persistente de datos en EMR porque desacopla el almacenamiento del cómputo, permitiendo escalar cada uno de forma independiente y pagar solo por el almacenamiento utilizado. HDFS, aunque es una opción, acopla el almacenamiento al clúster, lo que puede ser menos rentable para cargas de trabajo de larga duración. Las instancias Graviton son más rentables que las instancias basadas en x86 para muchas cargas de trabajo de Spark debido a su mejor relación rendimiento-precio y menor consumo de energía. Usar Spot Instances para los nodos primarios no es recomendable debido a la necesidad de alta fiabilidad y la naturaleza de larga duración de las cargas de trabajo, ya que las interrupciones de Spot pueden afectar la disponibilidad del clúster.
Aprueba tu examen — sin la interminable búsqueda de respuestas
Obtén todas las preguntas y explicaciones verificadas para este examen en un solo lugar, y ahorra horas de preparación. Más de 1,000 certificaciones · Más de 20 idiomas · Empieza gratis.
Aprueba tu examen más rápido → No se requiere tarjeta