Amazon DOP-C02: Arquitecturas Orientadas a Eventos y Automatización — Guía de estudio

Forma parte de la AWS DevOps Engineer Professional DOP-C02 — Guía de estudio. Practica con respuestas verificadas en el centro de exámenes de Amazon, o realiza tests cronometrados en ExamRoll.io.

Enrutamiento, orquestación y programación: EventBridge y Step Functions

Amazon EventBridge es el bus de eventos central para el enrutamiento, la gobernanza y la integración entre cuentas y dominios de eventos. Usa el bus predeterminado para eventos de servicios de AWS, buses personalizados para segmentar dominios y aplicar permisos, y buses de socios para integraciones con SaaS. Las reglas coinciden con los eventos mediante patrones basados en contenido y pueden tener como destino más de 200 servicios de AWS. Usa transformadores de entrada para dar forma a los payloads y la función de archivar/reproducir para reprocesar eventos históricos durante una recuperación o la incorporación de nuevos consumidores. Las políticas de recursos permiten el enrutamiento de eventos entre cuentas para consolidar la gobernanza en una cuenta de plataforma. EventBridge Pipes proporciona flujos punto a punto configurables desde orígenes de eventos (SQS, Kinesis, DynamoDB Streams, Apache Kafka autogestionado en Amazon MSK y otros) hacia destinos, con filtrado, procesamiento por lotes, transformación y enriquecimiento integrados a través de Lambda o Step Functions. Es ideal cuando no quieres gestionar una aplicación de consumidor completa pero necesitas una mediación ligera. EventBridge Scheduler ofrece programaciones de una sola vez y tipo cron para invocar destinos con un rol de ejecución, soporte para zonas horarias y ventanas de tiempo flexibles opcionales para reducir el efecto de estampida (thundering herds).

AWS Step Functions orquesta flujos de trabajo distribuidos definidos en Amazon States Language con estados como Task, Choice, Parallel, Map (incluido Map distribuido), Wait, Pass, Succeed/Fail, y patrones robustos de reintento (Retry) y captura de errores (Catch). Las integraciones profundas con servicios eliminan la necesidad de código de acoplamiento (glue code) para llamar a las API de AWS, incluyendo patrones síncronos (.sync) y de callback con tokens de tarea. Elige flujos de trabajo estándar (Standard Workflows) para orquestaciones de larga duración y con mucha auditoría, con una progresión de estado de tipo exactly-once, una duración de hasta un año y un precio por transición de estado; el historial de ejecución se conserva, con una gran visibilidad y trazas de X-Ray integradas. Elige flujos de trabajo rápidos (Express Workflows) para orquestaciones de alto rendimiento y corta duración (de segundos a minutos) donde puedes optar por un precio por solicitud + duración y una semántica de ejecución at-least-once a cambio de una escala masiva; úsalos para enriquecimientos en la ingesta de streams, enrutadores de eventos y microorquestaciones donde puedes hacer que las tareas sean idempotentes. Aplica patrones como el patrón saga con tareas de compensación y un manejo de errores centralizado; externaliza los reintentos y los tiempos de espera (timeouts) en la máquina de estados para simplificar el código de las tareas.

Disparadores de cómputo y contrapresión (backpressure): Mapeos de orígenes de eventos de Lambda

Los mapeos de orígenes de eventos de Lambda (ESM) conectan orígenes basados en sondeo (poll-based) con Lambda y controlan la concurrencia, el procesamiento por lotes y el manejo de errores.

El filtrado de eventos en los ESM reduce las invocaciones al descartar eventos no relevantes en el propio sondeador (poller). Usa la agregación en ventanas de saltos temporales (tumbling window) en los streams con Lambda para agregar registros a lo largo del tiempo para patrones de procesamiento de minilotes.

Automatización de operaciones y remediación: Systems Manager Automation y OpsCenter

AWS Systems Manager Automation proporciona runbooks (documentos de tipo Automation) escritos en JSON/YAML con pasos como

undefined

,

undefined

,

undefined

,

undefined

,

undefined

y

undefined

. Las automatizaciones (Automations) aceptan parámetros, emiten salidas, se versionan con un historial de cambios y se ejecutan con un rol dedicado AutomationAssumeRole para operaciones con privilegio mínimo y entre cuentas y regiones. Controle la concurrencia y los umbrales de error en todas las flotas, requiera aprobaciones y ventanas de Change Calendar, e intégrese con notificaciones a través de SNS. Invoque las automatizaciones según una programación, desde reglas de EventBridge (para la remediación casi en tiempo real de eventos de AWS Health, CloudWatch o API), desde remediaciones de AWS Config para hacer cumplir las políticas (por ejemplo, aplicando etiquetas predeterminadas a los volúmenes de EBS o adjuntando un perfil de instancia predeterminado a las instancias de EC2) y desde OpsCenter.

OpsCenter agrega los problemas operativos en OpsItems a partir de alarmas de CloudWatch, AWS Config, eventos de Health o fuentes personalizadas. Cada OpsItem realiza un seguimiento del estado, la prioridad, la deduplicación, los recursos relacionados y los enlaces a runbooks. Asocie runbooks de un solo clic para soluciones estándar y habilite la remediación automática conectando reglas de EventBridge o Config para iniciar una Automation específica cuando se cree o actualice un OpsItem a una condición coincidente (por ejemplo, un grupo de seguridad que permita 0.0.0.0/0 en SSH, una desviación en el cumplimiento de parches o copias de seguridad fallidas). Use Systems Manager Explorer para visualizar el estado de la flota y los OpsItems abiertos entre cuentas y regiones. Esta combinación —OpsItems como registros duraderos más runbooks de Automation como soluciones codificadas— permite operaciones auditables y consistentes a escala.

Guía de diseño y operativa

Diseñe para la idempotencia en todos los consumidores, ya que la entrega de tipo at-least-once (al menos una vez) es común. Prefiera el fan-out basado en eventos a través de SNS o reglas de EventBridge para reacciones paralelas de baja latencia; prefiera SQS para amortiguar (buffer) las cargas de trabajo y proteger a los productores de la lentitud de los consumidores; prefiera Kinesis cuando se requiera un orden estricto por shard y flujos de datos (streams) reproducibles para analítica. Use EventBridge Pipes para una integración ligera y gestionada entre orígenes y destinos cuando un consumidor a medida es excesivo, y EventBridge Scheduler para disparadores (triggers) basados en tiempo sin mantener una infraestructura de cron.

Dimensione correctamente los tiempos de espera (timeouts) y los reintentos. Para SQS, el tiempo de espera de visibilidad (visibility timeout) debe exceder el procesamiento máximo más los reintentos; para los flujos de datos, limite los reintentos y establezca MaximumRecordAgeInSeconds para evitar reproducir indefinidamente registros erróneos. Use DLQs o destinos on-failure (en caso de fallo) sistemáticamente y agregue paneles (dashboards) y alarmas sobre SQS ApproximateAgeOfOldestMessage, Lambda ConcurrentExecutions/Throttles/Errors, IteratorAge, Step Functions ExecutionFailed/TimedOut y EventBridge FailedInvocations. Cuando el tráfico con picos (spiky) es inevitable pero los SLAs de latencia son estrictos, use la concurrencia aprovisionada de Lambda para precalentar (pre-warm) la capacidad. Para la gobernanza, prefiera EventBridge con políticas de recursos para el enrutamiento entre cuentas (cross-account) y el archivado/reproducción (archive/replay) para soportar la evolución de los consumidores y la recuperación de incidentes.

Escenario de problema práctico

Shopify necesita modernizar el procesamiento de pedidos para eventos de ventas relámpago (flash-sale) mientras añade analítica en tiempo real y remediación automatizada cuando los servicios dependientes (downstream) se ralentizan o fallan.

  1. Ingerir y distribuir eventos de pedido (fan-out)
  1. Amortiguar y procesar el cumplimiento de pedidos
  1. Orquestar una saga de múltiples pasos
  1. Enrutar eventos de dominio a capacidades
  1. Conectar (pipe) el feed de un socio para enriquecimiento
  1. Analítica y búsqueda en tiempo real
  1. Automatización basada en tiempo
  1. Remediación y operaciones automatizadas

Este diseño soporta los picos de las ventas relámpago a través del buffering y el fan-out, preserva las invariantes del negocio mediante la orquestación, entrega analítica en segundos y cierra el ciclo con una remediación automatizada y dirigida por políticas.


Alta Disponibilidad · Todos los dominios · Almacenamiento

Practica estas preguntas → · Práctica cronometrada en ExamRoll.io →

Pass the whole exam — not just this question

You found this answer. Get every verified question and explanation in one place, and save hours of prep. Free to start.

Aprueba tu examen →

Explorar Amazon →

Related guides

Acceso todo en uno

Una suscripción. Todos los exámenes.

Cada plan desbloquea la búsqueda ilimitada de respuestas, pruebas de práctica, explicaciones de AI y la biblioteca completa de recursos, en más de 20 idiomas.

Mensual
24.87
Just €0.83/day
Todo incluido:
  • Búsqueda ilimitada de respuestas
  • Pruebas de práctica ilimitadas
  • Explicaciones con tecnología AI
  • Biblioteca completa de recursos
  • Más de 20 idiomas
  • Actualizaciones semanales de contenido
  • Recompensas y referencias
  • Soporte prioritario
Iniciar prueba gratuita

No se requiere tarjeta de crédito*

Mejor valor
12 meses
179.87
Just €0.49/daySave 40%
Todo incluido:
  • Búsqueda ilimitada de respuestas
  • Pruebas de práctica ilimitadas
  • Explicaciones con tecnología AI
  • Biblioteca completa de recursos
  • Más de 20 idiomas
  • Actualizaciones semanales de contenido
  • Recompensas y referencias
  • Soporte prioritario
Iniciar prueba gratuita

No se requiere tarjeta de crédito*

✓ Plan gratuito incluido · ✓ Cancela en cualquier momento · ✓ Todos los planes desbloquean el producto completo