Ponte en Contacto

Temario del curso

Introducción al Aprendizaje por Refuerzo y la IA Agéntica

  • Toma de decisiones bajo incertidumbre y planificación secuencial
  • Componentes clave de RL: agentes, entornos, estados y recompensas
  • El papel de RL en los sistemas de IA adaptativos y agénticos

Procesos de Decisión de Markov (MDP)

  • Definición formal y propiedades de los MDP
  • Funciones de valor, ecuaciones de Bellman y programación dinámica
  • Evaluación, mejora e iteración de políticas

Aprendizaje por Refuerzo Basado en Valores (Model-Free)

  • Aprendizaje Monte Carlo y Temporal-Difference (TD)
  • Q-learning y SARSA
  • Práctica: Implementación de métodos tabulares de RL en Python

Aprendizaje Profundo por Refuerzo

  • Combinación de redes neuronales con RL para la aproximación de funciones
  • Redes Q-Profundas (DQN) y repetición de experiencias
  • Arquitecturas Actor-Critic y gradientes de política
  • Práctica: Entrenamiento de un agente utilizando DQN y PPO con Stable-Baselines3

Estrategias de Exploración y Moldeado de Recompensas

  • Equilibrar la exploración frente a la explotación (ε-greedy, UCB, métodos de entropía)
  • Diseño de funciones de recompensa y prevención de comportamientos no deseados
  • Moldeado de recompensas y aprendizaje por currículo

Temas Avanzados en RL y Toma de Decisiones

  • Aprendizaje por refuerzo multiagente y estrategias cooperativas
  • Aprendizaje por refuerzo jerárquico y marco de opciones
  • RL offline y aprendizaje por imitación para una implementación más segura

Entornos de Simulación y Evaluación

  • Uso de OpenAI Gym y entornos personalizados
  • Espacios de acción continuos vs. discretos
  • Métricas para el rendimiento, la estabilidad y la eficiencia de muestreo del agente

Integración de RL en Sistemas de IA Agéntica

  • Combinación del razonamiento y el RL en arquitecturas híbridas de agentes
  • Integración del aprendizaje por refuerzo con agentes que utilizan herramientas
  • Consideraciones operativas para la escalabilidad y la implementación

Proyecto Final (Capstone)

  • Diseño e implementación de un agente de aprendizaje por refuerzo para una tarea simulada
  • Análisis del rendimiento del entrenamiento y optimización de hiperparámetros
  • Demostración de comportamiento adaptativo y toma de decisiones en un contexto agéntico

Resumen y Próximos Pasos

Requerimientos

  • Un sólido dominio de la programación en Python
  • Un buen conocimiento de los conceptos de aprendizaje automático y aprendizaje profundo
  • Familiaridad con la álgebra lineal, la probabilidad y los métodos básicos de optimización

Público Objetivo

  • Ingenieros en aprendizaje por refuerzo e investigadores de IA aplicada
  • Desarrolladores de robótica y automatización
  • Equipos de ingeniería que trabajan en sistemas de IA adaptativos y agénticos
 28 Horas

Número de participantes


Precio por participante

Reseñas (3)

Próximos cursos

Categorías Relacionadas