Nuevo video sobre Q-learning
Hoy he publicado un nuevo video en el canal de youtube donde explico uno de los algoritmos más simples (aunque no por ello menos potentes) de aprendizaje por refuerzo, el… Leer más »Nuevo video sobre Q-learning
Hoy he publicado un nuevo video en el canal de youtube donde explico uno de los algoritmos más simples (aunque no por ello menos potentes) de aprendizaje por refuerzo, el… Leer más »Nuevo video sobre Q-learning
Dentro del campo del aprendizaje por refuerzo existe una gran problema a la hora de realizar el entrenamiento, y ese es el problema del la exploración o explotación. Nunca se… Leer más »Explotación o exploración: el gran dilema
Los procesos o cadenas de Markov puede que a muchos les suenen vagamente de su época de estudiante, de haber leído que Jim Simons empezó a hacer trading con ellas… Leer más »Cadenas de Markov: ¿Pueden ayudarnos en el trading?
Uno de los grandes problemas que sucedía con el aprendizaje por refuerzo es que no existía una base común que reúna todos los posibles agentes que se hacían para poder… Leer más »Aprendizaje por refuerzo con Stable Baselines 3
Últimamente siempre escuchamos hablar de que una inteligencia artificial ha sido capaz de ganar a personas en determinados juegos y quizá no sepas del todo bien que hace para conseguir… Leer más »Primeros pasos en aprendizaje por refuerzo