Temario del curso
Fundamentos de las Operaciones en la Nube en AWS
- Roles y responsabilidades operativas en la nube
- Estructura de cuentas de AWS, organizaciones y estrategia de múltiples cuentas
- Servicios operativos clave: CloudWatch, CloudTrail, AWS Config
Infraestructura como Código y Aprovisionamiento
- Principios de IaC e infraestructura inmutable
- Aprovisionamiento con Terraform y AWS CloudFormation
- Gestión de estado, módulos y promoción de entornos
CI/CD y Estrategias de Despliegue
- Diseño de pipelines CI/CD para aplicaciones nativas de la nube
- Despliegues blue/green, canary y rolling
- Automatización de retrocesos, verificaciones de salud y validación de lanzamientos
Monitoreo, Observabilidad y Alertas
- Métricas, registros y trazas: envío, almacenamiento y análisis
- Uso de CloudWatch, X-Ray y herramientas de observabilidad de terceros
- Definición de SLO/SLI, políticas de alertas y prácticas de guardia
Operaciones de Seguridad y Gestión de Identidades
- Mejores prácticas de IAM, principio de menor privilegio y acceso entre cuentas
- Gestión de secretos, KMS y almacenes de parámetros seguros
- Seguridad operativa: estrategias de parcheo, análisis de vulnerabilidades y registros de auditoría
Resiliencia, Copias de Seguridad y Recuperación ante Desastres
- Diseño para tolerancia a fallos y alta disponibilidad
- Estrategias de copia de seguridad, automatización de instantáneas y procedimientos de restauración
- Planificación de recuperación ante desastres y creación de manuales de procedimientos
Optimización de Costos y Gobernanza
- Visibilidad de costos: facturación, etiquetado y estrategias de asignación de costos
- Dimensionamiento adecuado, instancias reservadas/planes de ahorro y controles de presupuesto
- Gobernanza: políticas, salvaguardas y automatización para el cumplimiento
Contenedores, Serverless y Operaciones en Tiempo de Ejecución
- Consideraciones operativas para ECS, EKS y Lambda
- Descubrimiento de servicios, escalado automático y límites de recursos
- Registro, trazas y depuración de cargas de trabajo en contenedores
Respuesta a Incidentes, Guiones de Acción e Ingeniería del Caos
- Respuesta a incidentes basada en manuales de procedimientos y prácticas de post-mortem
- Automatización de remediaciones y patrones de auto-curación
- Introducción a experimentos de caos para validar la resiliencia
Taller Práctico: Operar una Carga de Trabajo de Ejemplo
- Desplegar una aplicación de ejemplo utilizando IaC y un pipeline CI/CD
- Implementar monitoreo, alertas y un script de remediación automatizado
- Simular incidentes y practicar la respuesta basada en manuales de procedimientos
Resumen y Próximos Pasos
Requerimientos
- Comprensión básica de conceptos de nube y redes
- Familiaridad con la línea de comandos de Linux y la creación de scripts
- Experiencia con control de versiones (Git) y conceptos básicos de CI/CD
Público Objetivo
- Ingenieros de operaciones en la nube
- SRE e ingenieros de plataforma
- Ingenieros DevOps y líderes técnicos de equipos
Reseñas (1)
He descubierto cosas nuevas y interesantes sobre Lambda y Serverless
Oleg Buldumac - PUBLIC COURSE
Curso - AWS Lambda for Developers
Traducción Automática