Los análisis Batch MapReduce en Hadoop se están retrasando después de un aumento en el volumen de datos. ¿Cómo puede el equipo mejorar la capacidad de respuesta sin aumentar los costos?
Elige una respuesta
Toca una opción para verificar tu respuesta.
Respuesta correcta: Reescribir el trabajo en Apache Spark..
Por qué esta es la respuesta
Reescribir el trabajo en Apache Spark es la mejor opción para mejorar la capacidad de respuesta sin aumentar los costos. Spark procesa datos en memoria, lo que es significativamente más rápido que el procesamiento basado en disco de MapReduce, especialmente con volúmenes de datos crecientes. Esto reduce los tiempos de ejecución sin requerir más hardware. Reescribir el trabajo en Pig no mejoraría el rendimiento fundamentalmente, ya que Pig se ejecuta sobre MapReduce. Aumentar el tamaño del clúster de Hadoop incrementaría los costos. Disminuir el tamaño del clúster de Hadoop, incluso con Hive, empeoraría el rendimiento.
Aprueba tu examen — sin la interminable búsqueda de respuestas
Obtén todas las preguntas y explicaciones verificadas para este examen en un solo lugar, y ahorra horas de preparación. Más de 1,000 certificaciones · Más de 20 idiomas · Empieza gratis.
Aprueba tu examen más rápido → No se requiere tarjeta