Contacta con nosotros

Temario del curso

Fundamentos de la depuración y evaluación con Mastra

  • Comprensión de los modelos de comportamiento de los agentes y sus modos de fallo
  • Principios centrales de depuración dentro de Mastra
  • Evaluación de acciones deterministas y no deterministas de los agentes

Configuración de entornos para pruebas de agentes

  • Configuración de sandboxes de prueba y espacios de evaluación aislados
  • Captura de logs, trazas y telemetría para un análisis detallado
  • Preparación de conjuntos de datos y prompts para pruebas estructuradas

Depuración del comportamiento de los agentes de IA

  • Rastreo de caminos de decisión y señales de razonamiento interno
  • Identificación de alucinaciones, errores y comportamientos no deseados
  • Uso de paneles de observabilidad para la investigación de causas raíz

Métricas de evaluación y frameworks de benchmarking

  • Definición de métricas de evaluación cuantitativas y cualitativas
  • Medición de la precisión, consistencia y cumplimiento contextual
  • Aplicación de conjuntos de datos de referencia para evaluaciones repetibles

Ingeniería de fiabilidad para agentes de IA

  • Diseño de pruebas de fiabilidad para agentes que funcionan durante largos periodos
  • Detección de desplazamiento (drift) y degradación en el rendimiento del agente
  • Implementación de salvaguardas para flujos de trabajo críticos

Procesos de garantía de calidad y automatización

  • Construcción de pipelines de QA para evaluación continua
  • Automatización de pruebas de regresión para las actualizaciones de los agentes
  • Integración del QA con CI/CD y flujos de trabajo empresariales

Técnicas avanzadas para la reducción de alucinaciones

  • Estrategias de prompting para reducir salidas indeseadas
  • Bucles de validación y mecanismos de autoverificación
  • Experimentación con combinaciones de modelos para mejorar la fiabilidad

Informes, monitorización y mejora continua

  • Desarrollo de informes de QA y paneles de puntuación (scorecards) de los agentes
  • Monitorización del comportamiento a largo plazo y de los patrones de error
  • Iteración sobre los frameworks de evaluación para sistemas en evolución

Resumen y próximos pasos

Requerimientos

  • Comprensión del comportamiento de los agentes de IA y las interacciones con modelos
  • Experiencia en la depuración o prueba de sistemas de software complejos
  • Familiaridad con herramientas de observabilidad o registro de logs

Público objetivo

  • Ingenieros de garantía de calidad (QA)
  • Ingenieros de fiabilidad de IA
  • Desarrolladores responsables de la calidad y el rendimiento de los agentes
 21 Horas

Número de participantes


Precio por participante

Próximos cursos

Categorías Relacionadas