Gracias por enviar su consulta! Uno de los miembros de nuestro equipo se pondrá en contacto con usted en breve.
Gracias por enviar su reserva! Uno de los miembros de nuestro equipo se pondrá en contacto con usted en breve.
Temario del curso
Introducción a los LLMs de código abierto
- ¿Qué son los modelos de peso abierto y por qué son importantes?
- Descripción general de LLaMA, Mistral, Qwen y otros modelos de la comunidad
- Casos de uso para despliegues privados, on-premise o seguros
Configuración del entorno y herramientas
- Instalación y configuración de las bibliotecas Transformers, Datasets y PEFT
- Selección del hardware adecuado para el ajuste fino
- Carga de modelos preentrenados desde Hugging Face u otros repositorios
Preparación y preprocesamiento de datos
- Formatos de conjuntos de datos (ajuste de instrucciones, datos de chat, texto únicamente)
- Tokenización y gestión de secuencias
- Creación de conjuntos de datos personalizados y cargadores de datos (data loaders)
Técnicas de ajuste fino
- Ajuste completo estándar frente a métodos eficientes en parámetros
- Aplicación de LoRA y QLoRA para un ajuste fino eficiente
- Uso de la Trainer API para experimentación rápida
Evaluación y optimización del modelo
- Evaluación de modelos ajustados con métricas de generación y precisión
- Gestión del sobreajuste, la generalización y los conjuntos de validación
- Consejos de ajuste de rendimiento y registro (logging)
Despliegue y uso privado
- Guardado y carga de modelos para inferencia
- Despliegue de modelos ajustados en entornos empresariales seguros
- Estrategias de despliegue on-premise frente a la nube
Casos de estudio y casos de uso
- Ejemplos de uso empresarial de LLaMA, Mistral y Qwen
- Gestión del ajuste fino multilingüe y específico del dominio
- Discusión: compensaciones entre modelos abiertos y cerrados
Resumen y próximos pasos
Requerimientos
- Comprensión de los modelos de lenguaje grandes (LLMs) y su arquitectura
- Experiencia con Python y PyTorch
- Conocimiento básico del ecosistema de Hugging Face
Audiencia
- Profesionales de ML
- Desarrolladores de IA
14 Horas