Volver a resultados
Ficha bibliográfica · Consulta y acceso
Document

Aprendizaje por Refuerzo aplicado a la resolución de problemas no triviales

Errecalde, Marcelo Luis et al · SEDICI UNLP · 2000

Acceso abierto al texto completo
Lectura rápida. Revisá los datos básicos del recurso y luego accedé al contenido desde el botón principal. En esta ficha solo se muestra la información necesaria para identificar la obra, citarla y abrirla.

Acceso al recurso

Entrá al contenido desde la opción principal o elegí otra fuente disponible.

SEDICI UNLP SEDICI UNLP OAI-PMH
Entrar por SEDICI UNLP
Acceso principal

Acceso abierto al texto completo

Texto completo identificado como acceso abierto.
Abrir texto

Resumen

Descripción general del contenido del recurso.

El Aprendizaje por Refuerzo (en inglés Reinforcement Learning y de ahora en más AR) ataca el problema de aprender a controlar agentes autónomos, mediante interacciones por prueba y error con un ambiente dinámico, el cual le provee señales de refuerzo por cada acción que realiza. Si los objetivos del agente están definidos por la señal de refuerzo inmediata, la tarea del agente se reduce a aprender una estrategia de control (o política) que permita maximizar la recompensa acumulada a lo largo del tiempo (ver [14] para una formalización de esta tarea) Si bien en sus orígenes el AR sirvió como una herramienta teórica limitada a problemas con pequeños espacios de estados, en la actualidad sus aplicaciones han alcanzado áreas de considerable complejidad tales como robótica, manufacturación industrial, problemas de búsqueda combinatorial, etc. La aplicación del AR a problemas del mundo real, trajo aparejado la necesidad de adaptar las técnicas existentes en el área para manejar características complejas propias de este tipo de ambientes (ambientes estocásticos no estacionarios con grandes espacios de estados y/o acciones). En esta presentación, describimos el trabajo realizado por nuestro grupo de investigación en la aplicación del AR a problemas no triviales del mundo real. Para ello, describimos en las secciones 2 a 4, los 3 factores principales que a nuestro criterio deben ser tenidos en cuenta al trabajar con AR en este tipo de ambientes: balance entre exploración y explotación, aceleración del proceso de aprendizaje y generalización. La sección 5 por su parte, describe cuales son los avances y resultados que hemos logrado en relación a estos 3 ítems, y una breve descripción del plan de trabajo futuro Eje: Sistemas inteligentes. Metaheurísticas. Red de Universidades con Carreras en Informática (RedUNCI)

Cómo citar

Elegí el formato que necesitás y copiá la referencia al portapapeles.

APA 7

Errecalde, M. L. E. A. (2000). Aprendizaje por Refuerzo aplicado a la resolución de problemas no triviales. SEDICI UNLP. http://sedici.unlp.edu.ar/handle/10915/22106

MLA

Errecalde, Marcelo Luis et al. Aprendizaje por Refuerzo aplicado a la resolución de problemas no triviales. SEDICI UNLP, 2000. http://sedici.unlp.edu.ar/handle/10915/22106.

Chicago

Errecalde, Marcelo Luis et al. 2000. Aprendizaje por Refuerzo aplicado a la resolución de problemas no triviales. SEDICI UNLP. http://sedici.unlp.edu.ar/handle/10915/22106.

Harvard

Errecalde, M. L. E. A. 2000, Aprendizaje por Refuerzo aplicado a la resolución de problemas no triviales, SEDICI UNLP, available at: http://sedici.unlp.edu.ar/handle/10915/22106 [Accessed 5 Aug. 2026].

Compartir e imprimir

Guardá la ficha, copiá su enlace permanente o imprimila como PDF.

Exportar referencia

Si usás un gestor bibliográfico, podés exportar el registro en los formatos más comunes.

Detalles del recurso

Información bibliográfica útil para confirmar que se trata del material correcto.

Título
Aprendizaje por Refuerzo aplicado a la resolución de problemas no triviales
Autor / colaboradores
Errecalde, Marcelo Luis et al
Editorial
SEDICI UNLP
Año de publicación
2000
Idioma
Español

Materias

Explorá otros recursos relacionados a partir de estas materias.

Copiado