影响力指数
论文质量、代表作、近期表现、广度与样本量置信度综合计算
56.74/100
前 5.8%
全站排名 #3,744
发表论文14 篇
平均评分
年均产出4.7 篇/年
22
AgentGym-RL: An Open-Source Framework to Train LLM Agents for Long-Horizon Decision Making via Multi-Turn RL
ICLR 2026Oral
19
Critique-RL: Training Language Models For Critiquing Through Two-Stage Reinforcement Learning
ICLR 2026Poster
28
BAPO: Stabilizing Off-Policy Reinforcement Learning for LLMs via Balanced Policy Optimization with Adaptive Clipping
ICLR 2026Poster
24
A Benchmark for Self-Evolving Agents via Experience-Driven Lifelong Learning
ICLR 2026Rejected
14
Have the VLMs Lost Confidence? A Study of Sycophancy in VLMs
ICLR 2025Poster
22
RMB: Comprehensively benchmarking reward models in LLM alignment
ICLR 2025Poster
44
AgentGym: Evaluating and Evolving Large Language Model-based Agents across Diverse Envronments
ICLR 2025Rejected
4
SPA-VL: A Comprehensive Safety Preference Alignment Dataset for Vision Language Model
ICLR 2025Withdrawn
15
Progressive LLM Alignments Using Two-Player Games
ICLR 2025Rejected
一作13
Robust RLHF with Noisy Rewards
ICLR 2025Withdrawn