影响力指数
论文质量、代表作、近期表现、广度与样本量置信度综合计算
59.8/100
前 4.9%
全站排名 #3,131
发表论文7 篇
平均评分
年均产出3.5 篇/年
Remi Munos
研究方向
RLHF · large language models · deep reinforcement learning · bandit theory · reinforcement learning
12
Temporal Difference Flows
ICML 2025Oral
26
Beyond Verifiable Rewards: Scaling Reinforcement Learning in Language Models to Unverifiable Data
NeurIPS 2025Poster
通讯23
Asymmetric REINFORCE for off-Policy Reinforcement Learning: Balancing positive and negative rewards
NeurIPS 2025Poster
通讯23
Optimizing Language Models for Inference Time Objectives using Reinforcement Learning
ICML 2025Poster
通讯