Gracias por enviar su consulta! Uno de los miembros de nuestro equipo se pondrá en contacto con usted en breve.
Gracias por enviar su reserva! Uno de los miembros de nuestro equipo se pondrá en contacto con usted en breve.
Duración 14 horas
Temario del curso
Introducción a AIOps
- ¿Qué es AIOps y por qué es importante?
- Monitoreo tradicional vs. observabilidad impulsada por AIOps
- Arquitectura de AIOps y componentes clave
Recolección y Normalización de Datos Operativos
- Tipos de datos de observabilidad: métricas, registros y trazas
- Ingestión de datos de múltiples fuentes (servidores, contenedores, nube)
- Uso de agentes y exportadores (Prometheus, Beats, Fluentd)
Correlación de Datos y Detección de Anomalías
- Correlación de series temporales y métodos estadísticos
- Uso de modelos de ML para la detección de anomalías
- Detección de incidentes en sistemas distribuidos
Alertas y Reducción de Ruido
- Diseño de reglas y umbrales de alertas inteligentes
- Supresión, eliminación de duplicados y agrupación de alertas
- Integración con Alertmanager, Slack, PagerDuty u Opsgenie
Análisis de Causa Raíz y Visualización
- Uso de paneles de control para visualizar métricas y detectar tendencias
- Exploración de eventos y cronologías para el RCA (Análisis de Causa Raíz)
- Trazado de problemas a través de capas con herramientas de traza distribuida
Automatización y Remedación
- Disparación de scripts o flujos de trabajo automatizados desde incidentes
- Integración con sistemas ITSM (ServiceNow, Jira)
- Casos de uso: auto-cura, escalado, re-enrutamiento de tráfico
Plataformas de AIOps de Código Abierto y Comerciales
- Visión general de herramientas: Prometheus, Grafana, ELK, Moogsoft, Dynatrace
- Criterios de evaluación para la selección de una plataforma de AIOps
- Demostración y práctica con un stack seleccionado
Resumen y Próximos Pasos
Requerimientos
- Comprensión de los conceptos de operaciones de TI y monitoreo de sistemas
- Experiencia con herramientas de monitoreo o paneles de control
- Familiaridad con los formatos básicos de registros y métricas
Audiencia
- Equipos de operaciones responsables de la infraestructura y las aplicaciones
- Ingenieros de Confiabilidad del Sitio (SRE)
- Equipos de monitoreo de TI y observabilidad