影响力指数
论文质量、代表作、近期表现、广度与样本量置信度综合计算
43.62/100
前 11.9%
全站排名 #7,637
发表论文6 篇
平均评分
年均产出3.0 篇/年
Xu Wan
研究方向
large language model · reinforcement learning
20
Buffer Matters: Unleashing the Power of Off-Policy Reinforcement Learning in Large Language Model Reasoning
ICLR 2026Poster
一作18
Sample by Step, Optimize by Chunk: Chunk-Level GRPO for Text-to-Image Generation
ICLR 2026Rejected
20
SAMG: Offline-to-Online Reinforcement Learning via State-Action-Conditional Offline Model Guidance
ICLR 2026Rejected
二作5
Beyond Fixed Budgets: Dynamic Reasoning Efficiency Reward for Large Language Model
ICLR 2026Withdrawn
一作