影响力指数
论文质量、代表作、近期表现、广度与样本量置信度综合计算
55.64/100
前 6.2%
全站排名 #4,008
发表论文5 篇
平均评分
年均产出2.5 篇/年
Washim Uddin Mondal
研究方向
Reinforcement learning · mean-field control · multi-arm bandit problems
21
Finite-Sample Analysis of Policy Evaluation for Robust Average Reward Reinforcement Learning
NeurIPS 2025Poster
二作23
Global Convergence for Average Reward Constrained MDPs with Primal-Dual Actor Critic Algorithm
NeurIPS 2025Poster
三作13
A Sharper Global Convergence Analysis for Average Reward Reinforcement Learning via an Actor-Critic Approach
ICML 2025Poster
二作