顶见 · 经管顶刊中文导读
具有线性函数逼近的熵正则化自然策略梯度的收敛性
Convergence of Entropy-Regularized Natural Policy Gradient with Linear Function Approximation
SIAM Journal on Optimization · 2024
被引 6
ABS 3
Semih Çaycı
Niao He
R. Srikant
强化学习
优化理论
数学经济学
算法收敛性分析
阅读原文 ↗