影响力指数
论文质量、代表作、近期表现、广度与样本量置信度综合计算
73.84/100
前 2.1%
全站排名 #1,324
发表论文17 篇
平均评分
年均产出5.7 篇/年
Ilija Bogunovic
研究方向
Bandit optimization · Reinforcement learning · Sequential decision making · Reinforcement Learning from Human Feedback · Reinforcement learning for LLMs · Post-training of diffusion LLMs
16
wd1: Weighted Policy Optimization for Reasoning in Diffusion Language Models
ICLR 2026Poster
通讯13
This Is Your Doge, If It Please You: Exploring Deception and Robustness in Mixture of LLMs
ICLR 2026Rejected
三作12
RSPO: Regularized Self-Play Alignment of Large Language Models
ICLR 2026Rejected
通讯20
Robust Multi-Objective Controlled Decoding of Large Language Models
ICLR 2026Poster
通讯28
Overton Pluralistic Reinforcement Learning for Large Language Models
ICLR 2026Rejected
三作25
Imagined Autocurricula
NeurIPS 2025Poster
12
Sample Efficient Preference Alignment in LLMs via Active Exploration
COLM 2025Poster
20
Synthetic Data is Sufficient for Zero-Shot Visual Generalization from Offline Data
ICLR 2025Rejected
三作9
Right Now, Wrong Then: Non-Stationary Direct Preference Optimization under Preference Drift
ICML 2025Poster
通讯19
Right Now, Wrong Then: Non-Stationary Direct Preference Optimization under Preference Drift
ICLR 2025Rejected
通讯