Gracias por enviar su consulta! Uno de los miembros de nuestro equipo se pondrá en contacto con usted en breve.
Gracias por enviar su reserva! Uno de los miembros de nuestro equipo se pondrá en contacto con usted en breve.
Temario del curso
Conceptos y métricas de rendimiento
- Latencia, rendimiento, uso de energía, utilización de recursos
- Cuellos de botella a nivel de sistema frente a nivel de modelo
- Perfilado para inferencia frente a entrenamiento
Perfilado en Huawei Ascend
- Uso de CANN Profiler y MindInsight
- Diagnóstico de kernels y operadores
- Patrones de descarga (offload) y mapeo de memoria
Perfilado en GPU Biren
- Características de monitorización de rendimiento del SDK de Biren
- Fusión de kernels, alineación de memoria y colas de ejecución
- Perfilado consciente de la energía y la temperatura
Perfilado en Cambricon MLU
- Herramientas de rendimiento BANGPy y Neuware
- Visibilidad a nivel de kernel e interpretación de registros
- Integración del perfilador MLU con marcos de implementación
Optimización a nivel de gráfico y modelo
- Estrategias de poda de gráficos y cuantización
- Fusión de operadores y reestructuración del grafo computacional
- Normalización del tamaño de entrada y ajuste por lotes (batch)
Optimización de memoria y kernel
- Optimización de la disposición de la memoria y su reutilización
- Gestión eficiente de búferes entre diferentes conjuntos de chips
- Técnicas de ajuste a nivel de kernel específicas por plataforma
Mejores prácticas multiplataforma
- Portabilidad del rendimiento: estrategias de abstracción
- Creación de flujos de trabajo de ajuste compartidos para entornos multicchip
- Ejemplo: ajuste de un modelo de detección de objetos en Ascend, Biren y MLU
Resumen y próximos pasos
Requerimientos
- Experiencia trabajando con flujos de entrenamiento o implementación de modelos de IA
- Comprensión de los principios de cómputo GPU/MLU y optimización de modelos
- Dominio básico de herramientas y métricas de perfilado de rendimiento
Público objetivo
- Ingenieros de rendimiento
- Equipos de infraestructura de aprendizaje automático
- Arquitectos de sistemas de IA
21 Horas