影响力指数
论文质量、代表作、近期表现、广度与样本量置信度综合计算
50.45/100
前 8.4%
全站排名 #5,393
发表论文8 篇
平均评分
年均产出4.0 篇/年
14
Risk-Sensitive Reinforcement Learning for Alleviating Exploration Dilemmas in Large Language Models
ICLR 2026Poster
一作10
PAG: Multi-Turn Reinforced LLM Self-Correction with Policy as Generative Verifier
ICLR 2026Desk Rejected
一作22
OPRIDE: Efficient Offline Preference-based Reinforcement Learning via In-Dataset Exploration
ICLR 2026Poster
18
GlobeDiff: State Diffusion Process for Partial Observability in Multi-Agent System
ICLR 2026Poster
三作25
Episodic Novelty Through Temporal Distance
ICLR 2025Poster
一作27
Fewer May Be Better: Enhancing Offline Reinforcement Learning with Reduced Dataset
ICLR 2025Poster
24
Maximum Next-State Entropy for Efficient Reinforcement Learning
ICLR 2025Withdrawn
23
Fewer Questions, Better Answers: Efficient Offline Preference-based Reinforcement Learning via In-Dataset Exploration
ICLR 2025Rejected