Loading...
Aprendizaje por refuerzo con opciones y función de refuerzo universal
Bruno Cilla, Diego ; Heimann, Matías ; Scaglioni, Giuliano
Bruno Cilla, Diego
Heimann, Matías
Scaglioni, Giuliano
Type
Proyecto final de grado
Citations
Altmetric:
Abstract
"El objetivo de los algoritmos de aprendizaje por refuerzo es maximizar las recompensas acumuladas a lo largo del tiempo para hallar un comportamiento objetivo. De esta forma, para aprender distintos comportamientos, la variable a cambiar sería la función de refuerzo dada para ese problema.
El objetivo de este trabajo es explorar una alternativa en la cual se puedan adquirir distintos comportamientos, manteniendo siempre la misma función de refuerzo, siendo que la variable sea los distintos entornos en los que se realiza el aprendizaje."
Description
Date
2020-12
Journal Title
Journal ISSN
Volume Title
Publisher
Collections
Files
Loading...
Proyecto_Final_Bruno
Adobe PDF, 955.54 KB
Research Projects
Organizational Units
Journal Issue
Keywords
APRENDIZAJE POR REFUERZO, APRENDIZAJE AUTOMATICO, ALGORITMOS