Ponte en Contacto

Temario del curso

Introducción a LLMOps

  • LLMOps vs MLOps: desafíos únicos de operar LLMs
  • El ciclo de vida de la aplicación LLM: prompt, evaluar, desplegar, monitorear
  • Lista de verificación de preparación para producción de aplicaciones GenAI

Gestión y versionado de prompts

  • Sistemas de plantillas de prompts e inyección de variables
  • Versionado semántico para prompts con pruebas de regresión automatizadas
  • Registros de prompts y flujos de trabajo de colaboración

Evaluación de LLM a escala

  • Dimensiones de evaluación: precisión, relevancia, seguridad y fundamentación (groundedness)
  • Métricas de LLM como juez y pipelines de evaluación humana
  • Frameworks de evaluación automatizada: RAGAS, DeepEval y evaluadores personalizados
  • Puertas de calidad en CI/CD para despliegues de LLM

Barreras de seguridad y gobernanza de contenido

  • Barreras de entrada y salida: NeMo Guardrails y Guardrails AI
  • Detección de PII, filtrado de toxicidad y límites de temas
  • Estrategias de defensa contra jailbreak e inyección de prompts
  • Pruebas de penetración (red-teaming) de aplicaciones LLM para asegurar la seguridad

Observabilidad y monitoreo de LLM

  • Telemetría: uso de tokens, latencia, costo y métricas de calidad
  • Detección de deriva (drift) en salidas de LLM y espacios de incrustación (embeddings)
  • Rastreo a nivel de sesión para conversaciones multi-turno con agentes
  • Paneles y alertas con LangSmith, Arize y OpenTelemetry

Pasarela de IA y orquestación de modelos

  • Enrutamiento multi-proveedor con LiteLLM y Portkey
  • Estrategias de respaldo, lógica de reintento y interruptores de circuito (circuit breakers)
  • Selección de modelos consciente del costo y balanceo de carga
  • Limitación de velocidad (rate limiting), gestión de cuotas y gobernanza de claves API

Optimización del rendimiento

  • Caché semántico con almacenes vectoriales y estrategias de coincidencia exacta
  • Aplicación de salida estructurada mediante decodificación restringida
  • Patrones de agrupamiento (batching), transmisión (streaming) y concurrencia
  • Optimización de la latencia entre proveedores de modelos

Gobernanza, cumplimiento y auditoría

  • Registros de auditoría de LLM: logs de prompts, logs de respuestas y procedencia de decisiones
  • Consideraciones de residencia de datos y privacidad para APIs de LLM
  • Política como código (policy-as-code) para el uso de LLM dentro de las organizaciones
  • Elaboración de un manual interno de operaciones de LLM

Requerimientos

  • Experiencia construyendo o integrando aplicaciones potenciadas por LLM.
  • Conocimiento familiaridad con Python y APIs REST.
  • Comprensión básica de los conceptos de ingeniería de prompts.

Audiencia

  • Ingenieros de ML y practicantes de MLOps que transicionan hacia las operaciones de LLM.
  • Ingenieros de plataforma responsables de la infraestructura de LLM.
  • Líderes técnicos que gestionan despliegues de GenAI en producción.
 14 Horas

Número de participantes


Precio por participante

Reseñas (2)

Próximos cursos

Categorías Relacionadas