Gracias por enviar su consulta! Uno de los miembros de nuestro equipo se pondrá en contacto con usted en breve.
Gracias por enviar su reserva! Uno de los miembros de nuestro equipo se pondrá en contacto con usted en breve.
Temario del curso
Introducción a los LLMs de código abierto
- Qué son los modelos de peso abierto y por qué son importantes.
- Visión general de LLaMA, Mistral, Qwen y otros modelos de la comunidad.
- Casos de uso para despliegues privados, on-premise o seguros.
Configuración del entorno y herramientas
- Instalación y configuración de las bibliotecas Transformers, Datasets y PEFT.
- Elegir el hardware apropiado para el ajuste fino.
- Cargar modelos preentrenados desde Hugging Face u otros repositorios.
Preparación y procesamiento de datos
- Formatos de conjuntos de datos (ajuste con instrucciones, datos de chat, solo texto).
- Tokenización y gestión de secuencias.
- Creación de conjuntos de datos personalizados y dataloaders.
Técnicas de ajuste fino
- Ajuste fino completo estándar frente a métodos eficientes en parámetros.
- Aplicación de LoRA y QLoRA para un ajuste eficiente.
- Uso de la API Trainer para experimentación rápida.
Evaluación y optimización del modelo
- Evaluación de modelos ajustados mediante métricas de generación y precisión.
- Gestión del sobreajuste, generalización y conjuntos de validación.
- Consejos de ajuste de rendimiento y registro (logging).
Despliegue y uso privado
- Guardar y cargar modelos para inferencia.
- Implementar modelos ajustados en entornos empresariales seguros.
- Estrategias de despliegue on-premise frente a la nube.
Casos de estudio y ejemplos de uso
- Ejemplos de uso empresarial de LLaMA, Mistral y Qwen.
- Manejo de ajuste fino multilingüe y específico del dominio.
- Debate: Compensaciones entre modelos abiertos y cerrados.
Resumen y próximos pasos
Requerimientos
- Comprensión de los modelos de lenguaje grandes (LLMs) y su arquitectura.
- Experiencia con Python y PyTorch.
- Familiaridad básica con el ecosistema de Hugging Face.
Audiencia
- Profesionales de ML.
- Desarrolladores de IA.
14 Horas