Solicitar información

Temario del curso

Introducción al aprendizaje por refuerzo y la IA agéntica

  • Toma de decisiones bajo incertidumbre y planificación secuencial
  • Componentes clave del RL: agentes, entornos, estados y recompensas
  • El papel del RL en los sistemas de IA adaptativos y agénticos

Procesos de decisión de Markov (MDP)

  • Definición formal y propiedades de los MDP
  • Funciones de valor, ecuaciones de Bellman y programación dinámica
  • Evaluación, mejora e iteración de políticas

Aprendizaje por refuerzo sin modelo

  • Aprendizaje Monte Carlo y por Diferencia Temporal (TD)
  • Q-learning y SARSA
  • Práctica: implementación de métodos tabulares de RL en Python

Aprendizaje profundo por refuerzo

  • Combinación de redes neuronales con RL para la aproximación de funciones
  • Redes Q Profundas (DQN) y reproducción de experiencias
  • Arquitecturas Actor-Crítico y gradientes de política
  • Práctica: entrenamiento de un agente usando DQN y PPO con Stable-Baselines3

Estrategias de exploración y diseño de recompensas

  • Equilibrar la exploración frente a la explotación (ε-greedy, UCB, métodos de entropía)
  • Diseño de funciones de recompensa y evitación de comportamientos no deseados
  • Modelado de recompensas y aprendizaje curricular

Temas avanzados en RL y toma de decisiones

  • Aprendizaje por refuerzo multiagente y estrategias cooperativas
  • Aprendizaje por refuerzo jerárquico y marco de opciones
  • RL offline y aprendizaje por imitación para una implementación más segura

Entornos de simulación y evaluación

  • Uso de OpenAI Gym y entornos personalizados
  • Espacios de acción continuos frente a discretos
  • Métricas para el rendimiento, la estabilidad y la eficiencia de muestreo del agente

Integración del RL en sistemas de IA agénticos

  • Combinación de razonamiento y RL en arquitecturas híbridas de agentes
  • Integración del aprendizaje por refuerzo con agentes que utilizan herramientas
  • Consideraciones operativas para la escalabilidad y la implementación

Proyecto final

  • Diseño e implementación de un agente de aprendizaje por refuerzo para una tarea simulada
  • Análisis del rendimiento de entrenamiento y optimización de hiperparámetros
  • Demuestra de comportamiento adaptativo y toma de decisiones en un contexto agéntico

Resumen y próximos pasos

Requerimientos

  • Sólida competencia en programación con Python
  • Comprensión sólida de los conceptos de aprendizaje automático y aprendizaje profundo
  • Familiaridad con el álgebra lineal, la probabilidad y los métodos básicos de optimización

Público objetivo

  • Ingenieros de aprendizaje por refuerzo e investigadores de IA aplicada
  • Desarrolladores de robótica y automatización
  • Equipos de ingeniería que trabajan en sistemas de IA agénticos y adaptativos
 28 Horas

Formación Corporativa a Medida

Soluciones de formación diseñadas exclusivamente para empresas.

  • Contenido personalizado: Adaptamos el temario y los ejercicios prácticos a los objetivos y necesidades reales del proyecto.
  • Calendario flexible: Fechas y horarios adaptados a la agenda de su equipo.
  • Modalidad: Online (en directo), In-company (en sus oficinas) o Híbrida.
Inversión

Precio por grupo privado (formación online) desde 5800 € + IVA*

Contáctenos para obtener un presupuesto exacto y conocer nuestras promociones actuales

Reseñas (3)

Próximos cursos

Categorías Relacionadas