Joint Optimization of Concave Scalarized Multi-Objective Reinforcement Learning with Policy Gradient Based Algorithm
From MaRDI portal
Publication:5101314
DOI10.1613/JAIR.1.13981OpenAlexW4290987548WikidataQ114961804 ScholiaQ114961804MaRDI QIDQ5101314
Mridul Agarwal, Qinbo Bai, Vaneet Aggarwal
Publication date: 30 August 2022
Published in: Journal of Artificial Intelligence Research (Search for Journal in Brave)
Full work available at URL: https://arxiv.org/abs/2105.14125
This page was built for publication: Joint Optimization of Concave Scalarized Multi-Objective Reinforcement Learning with Policy Gradient Based Algorithm