非马尔可夫域中完全无模型的演员-评论家递归神经网络强化学习

Totally model-free actor-critic recurrent neural-network reinforcement learning in non-Markovian domains

Annals of Operations Research · 2016
被引 9
ABS 3
强化学习递归神经网络人工智能计算机科学算法