Ponte en Contacto

Temario del curso

Fundamentos de Operaciones en la Nube en AWS

  • Roles y responsabilidades operativas en la nube.
  • Estructura de cuentas de AWS, organizaciones y estrategia de múltiples cuentas.
  • Servicios operativos clave: CloudWatch, CloudTrail y AWS Config.

Infraestructura como Código (IaC) y Aprovisionamiento

  • Principios de IaC e infraestructura inmutable.
  • Aprovisionamiento con Terraform y AWS CloudFormation.
  • Gestión de estado, módulos y promoción de entornos.

CI/CD y Estrategias de Despliegue

  • Diseño de pipelines de CI/CD para aplicaciones nativas de la nube.
  • Despliegues azul/verde, canary (ensayo y error parcial) y rodantes (rolling).
  • Automatización de reversión (rollback), comprobaciones de salud y validación de liberaciones.

Monitoreo, Observabilidad y Alertas

  • Métricas, registros y trazas: envío, almacenamiento y análisis.
  • Uso de CloudWatch, X-Ray y herramientas de observabilidad de terceros.
  • Definición de SLO/SLI, políticas de alertas y prácticas de guardia (on-call).

Operaciones de Seguridad y Gestión de Identidad

  • Mejores prácticas de IAM, principio de mínimo privilegio y acceso entre cuentas.
  • Gestión de secretos, KMS y almacenes de parámetros seguros.
  • Seguridad operativa: estrategias de parches, análisis de vulnerabilidades y auditorías.

Resiliencia, Respaldos y Recuperación ante Desastres

  • Diseño para tolerancia a fallos y alta disponibilidad.
  • Estrategias de respaldo, automatización de instantáneas y procedimientos de restauración.
  • Planificación de recuperación ante desastres y creación de manuales de procedimientos (runbooks).

Optimización de Costos y Gobernanza

  • Visibilidad de costos: facturación, etiquetado y estrategias de asignación de costos.
  • Redimensionamiento (rightsizing), instancias reservadas/planes de ahorro y controles de presupuesto.
  • Gobernanza: políticas, barreras (guardrails) y automatización para el cumplimiento.

Contenedores, Sin Servidores (Serverless) y Operaciones de Ejecución

  • Consideraciones operativas para ECS, EKS y Lambda.
  • Descubrimiento de servicios, escalado automático (autoscaling) y límites de recursos.
  • Registro, trazado y depuración de cargas de trabajo containerizadas.

Respuesta a Incidentes, Playbooks e Ingeniería del Caos

  • Respuesta a incidentes guiada por manuales de procedimientos (runbooks) y prácticas de análisis posterior (postmortem).
  • Automatización de la remediación y patrones de auto-sanación.
  • Introducción a experimentos de caos para validar la resiliencia.

Taller Práctico: Operar una Carga de Trabajo de Ejemplo

  • Desplegar una aplicación de ejemplo utilizando IaC y un pipeline de CI/CD.
  • Implementar monitoreo, alertas y un script de remediación automatizada.
  • Simular incidentes y practicar la respuesta basada en manuales de procedimientos.

Resumen y Próximos Pasos

Requerimientos

  • Comprensión básica de conceptos de nube y redes.
  • Familiaridad con la línea de comandos de Linux y la creación de scripts.
  • Experiencia con control de versiones (Git) y conceptos básicos de CI/CD.

Público Objetivo

  • Ingenieros de operaciones en la nube.
  • Especialistas en SRE (Site Reliability Engineering) e ingenieros de plataformas.
  • Ingenieros DevOps y líderes de equipos técnicos.
 21 Horas

Número de participantes


Precio por participante

Reseñas (1)

Próximos cursos

Categorías Relacionadas