影响力指数
论文质量、代表作、近期表现、广度与样本量置信度综合计算
43.42/100
前 12%
全站排名 #7,742
发表论文9 篇
平均评分
年均产出4.5 篇/年
14
Risk-Sensitive Reinforcement Learning for Alleviating Exploration Dilemmas in Large Language Models
ICLR 2026Poster
通讯10
PAG: Multi-Turn Reinforced LLM Self-Correction with Policy as Generative Verifier
ICLR 2026Desk Rejected
通讯6
Process Supervision-Guided Policy Optimization for Code Generation
ICLR 2026Rejected
通讯6
Truncated Proximal Policy Optimization
ICLR 2026Rejected
23
EvaLearn: Quantifying the Learning Capability and Efficiency of LLMs via Sequential Problem Solving
NeurIPS 2025Poster
21
DAPO: An Open-Source LLM Reinforcement Learning System at Scale
NeurIPS 2025Poster
17
Exploring Data Scaling Trends and Effects in Reinforcement Learning from Human Feedback
NeurIPS 2025Poster
通讯26
Process Supervision-Guided Policy Optimization for Code Generation
ICLR 2025Rejected
通讯27
Enhancing Multi-Step Reasoning Abilities of Language Models through Direct Q-Function Optimization
ICLR 2025Rejected
通讯