scientific article
From MaRDI portal
Publication:3188018
zbMath1367.68318MaRDI QIDQ3188018
Jan Peters, Christian Daniel, Oliver Krömer, Gerhard Neumann
Publication date: 16 August 2016
Full work available at URL: http://jmlr.csail.mit.edu/papers/v17/15-188.html
Title: zbMATH Open Web Interface contents unavailable due to conflicting licenses.
reinforcement learningtemporal correlationrobot learningrobust learningstructured learningpolicy searchhierarchical learningmotor skill learningHiREPSREPS
Learning and adaptive systems in artificial intelligence (68T05) Artificial intelligence for robotics (68T40)
Related Items (10)
Probabilistic inference for determining options in reinforcement learning ⋮ Optimistic reinforcement learning by forward Kullback-Leibler divergence optimization ⋮ Variational policy search using sparse Gaussian process priors for learning multimodal optimal actions ⋮ Unnamed Item ⋮ A Reward-Maximizing Spiking Neuron as a Bounded Rational Decision Maker ⋮ Unnamed Item ⋮ Compatible natural gradient policy search ⋮ Unnamed Item ⋮ Unnamed Item ⋮ Unnamed Item
This page was built for publication: