影响力指数
论文质量、代表作、近期表现、广度与样本量置信度综合计算
17.79/100
前 46.9%
全站排名 #30,167
发表论文4 篇
平均评分
年均产出2.0 篇/年
Nguyen Minh Phuc
研究方向
Reinforcement Learning from Human Feedback · RLVR · Machine Learning
24
Mitigating Reward Over-optimization in Direct Alignment Algorithms with Importance Sampling
NeurIPS 2025Poster
一作27
Weak-to-strong Generalization via Formative Learning from Student Demonstrations & Teacher Evaluation
NeurIPS 2025Rejected
一作35
Mitigating Reward Over-optimization in Direct Alignment Algorithms with Adaptive Importance Sampling
ICLR 2025Rejected
一作