Gracias por enviar su consulta! Uno de los miembros de nuestro equipo se pondrá en contacto con usted en breve.
Gracias por enviar su reserva! Uno de los miembros de nuestro equipo se pondrá en contacto con usted en breve.
Temario del curso
Fundamentos de la depuración y evaluación con Mastra
- Comprensión de los modelos de comportamiento de los agentes y sus modos de fallo
- Principios centrales de depuración dentro de Mastra
- Evaluación de acciones deterministas y no deterministas de los agentes
Configuración de entornos para pruebas de agentes
- Configuración de sandboxes de prueba y espacios de evaluación aislados
- Captura de logs, trazas y telemetría para un análisis detallado
- Preparación de conjuntos de datos y prompts para pruebas estructuradas
Depuración del comportamiento de los agentes de IA
- Rastreo de caminos de decisión y señales de razonamiento interno
- Identificación de alucinaciones, errores y comportamientos no deseados
- Uso de paneles de observabilidad para la investigación de causas raíz
Métricas de evaluación y frameworks de benchmarking
- Definición de métricas de evaluación cuantitativas y cualitativas
- Medición de la precisión, consistencia y cumplimiento contextual
- Aplicación de conjuntos de datos de referencia para evaluaciones repetibles
Ingeniería de fiabilidad para agentes de IA
- Diseño de pruebas de fiabilidad para agentes que funcionan durante largos periodos
- Detección de desplazamiento (drift) y degradación en el rendimiento del agente
- Implementación de salvaguardas para flujos de trabajo críticos
Procesos de garantía de calidad y automatización
- Construcción de pipelines de QA para evaluación continua
- Automatización de pruebas de regresión para las actualizaciones de los agentes
- Integración del QA con CI/CD y flujos de trabajo empresariales
Técnicas avanzadas para la reducción de alucinaciones
- Estrategias de prompting para reducir salidas indeseadas
- Bucles de validación y mecanismos de autoverificación
- Experimentación con combinaciones de modelos para mejorar la fiabilidad
Informes, monitorización y mejora continua
- Desarrollo de informes de QA y paneles de puntuación (scorecards) de los agentes
- Monitorización del comportamiento a largo plazo y de los patrones de error
- Iteración sobre los frameworks de evaluación para sistemas en evolución
Resumen y próximos pasos
Requerimientos
- Comprensión del comportamiento de los agentes de IA y las interacciones con modelos
- Experiencia en la depuración o prueba de sistemas de software complejos
- Familiaridad con herramientas de observabilidad o registro de logs
Público objetivo
- Ingenieros de garantía de calidad (QA)
- Ingenieros de fiabilidad de IA
- Desarrolladores responsables de la calidad y el rendimiento de los agentes
21 Horas