Temario del curso
Fundamentos de las operaciones en la nube en AWS
- Roles y responsabilidades operativas en la nube
- Estructura de cuentas de AWS, organizaciones y estrategia multicuenta
- Servicios operativos principales: CloudWatch, CloudTrail y AWS Config
Infraestructura como Código y aprovisionamiento
- Principios de IaC e infraestructura inmutable
- Aprovisionamiento con Terraform y AWS CloudFormation
- Gestión de estado, módulos y promoción de entornos
CI/CD y estrategias de despliegue
- Diseño de pipelines CI/CD para aplicaciones nativas de la nube
- Despliegues blue/green, canary y graduals
- Automatización de rollbacks, verificaciones de salud y validación de lanzamientos
Monitoreo, observabilidad y alertas
- Métricas, registros y trazas: envío, almacenamiento y análisis
- Uso de CloudWatch, X-Ray y herramientas de observabilidad de terceros
- Definición de SLO/SLI, políticas de alerta y prácticas de guardia (on-call)
Operaciones de seguridad y gestión de identidades
- Mejores prácticas de IAM, principio de menor privilegio y acceso entre cuentas
- Gestión de secretos, KMS y almacenes de parámetros seguros
- Seguridad operativa: estrategias de parcheo, escaneo de vulnerabilidades y trazas de auditoría
Resiliencia, respaldos y recuperación ante desastres
- Diseño para tolerancia a fallos y alta disponibilidad
- Estrategias de respaldo, automatización de instantáneas y procedimientos de restauración
- Planificación de recuperación ante desastres y creación de runbooks
Optimización de costos y gobernanza
- Visibilidad de costos: facturación, etiquetado y estrategias de asignación de costos
- Dimensionamiento adecuado (rightsizing), instancias reservadas/planes de ahorro y controles de presupuesto
- Gobernanza: políticas, barreras (guardrails) y automatización para el cumplimiento
Contenedores, Serverless y operaciones de tiempo de ejecución
- Consideraciones operativas para ECS, EKS y Lambda
- Descubrimiento de servicios, escala automática y límites de recursos
- Registros, trazas y depuración de cargas de trabajo containerizadas
Respuesta a incidentes, manuales de procedimientos e ingeniería del caos
- Respuesta a incidentes basada en runbooks y prácticas de análisis post-mortem
- Automatización de la remediación y patrones de auto-reparación
- Introducción a experimentos de caos para validar la resiliencia
Taller práctico: Operar una carga de trabajo de muestra
- Desplegar una aplicación de muestra utilizando IaC y un pipeline CI/CD
- Implementar monitoreo, alertas y un script de remediación automatizado
- Simular incidentes y practicar la respuesta basada en runbooks
Resumen y próximos pasos
Requerimientos
- Comprensión básica de los conceptos de la nube y redes
- Familiaridad con la línea de comandos de Linux y la escritura de scripts
- Experiencia con control de versiones (Git) y conceptos básicos de CI/CD
Audiencia
- Ingenieros de operaciones en la nube
- SRE e ingenieros de plataforma
- Ingenieros DevOps y líderes técnicos de equipos
Reseñas (1)
He descubierto cosas nuevas y interesantes sobre Lambda y Serverless
Oleg Buldumac - PUBLIC COURSE
Curso - AWS Lambda for Developers
Traducción Automática