影响力指数
论文质量、代表作、近期表现、广度与样本量置信度综合计算
69.05/100
前 2.8%
全站排名 #1,815
发表论文10 篇
平均评分
年均产出3.3 篇/年
Mohammad Ghavamzadeh
研究方向
test-time scaling of GenAI models · diffusion models · post training of GenAI models · RLHF · bandit algorithms · online learning · reinforcement learning
15
Diffusion Blend: Inference-Time Multi-Preference Alignment for Diffusion Models
ICLR 2026Poster
16
Displacement-Resistant Extensions of DPO with Nonconvex $f$-Divergences
ICLR 2026Poster
通讯21
Beyond Binary Preferences: A Principled Framework for Reward Modeling with Ordinal Feedback
ICLR 2026Poster
通讯14
Alignment from Ranking and Rating Information
ICLR 2026Rejected
通讯