影响力指数
论文质量、代表作、近期表现、广度与样本量置信度综合计算
46.64/100
前 10%
全站排名 #6,469
发表论文9 篇
平均评分
年均产出4.5 篇/年
Haoming Jiang
研究方向
deep learning · transformer · BERT · NLP · pretraining · adversarial learning · robust · sparse
28
Think-RM: Enabling Long-Horizon Reasoning in Generative Reward Models
NeurIPS 2025Poster
17
Ask a Strong LLM Judge when Your Reward Model is Uncertain
NeurIPS 2025Poster
15
RRO: LLM Agent Optimization Through Rising Reward Trajectories
COLM 2025Poster
14
Discriminative Finetuning of Generative Large Language Models without Reward Models and Human Preference Data
ICML 2025Poster
15
Self-Rewarding PPO: Aligning Large Language Models with Demonstrations Only
COLM 2025Poster
6
Inductive or Deductive? Rethinking the Fundamental Reasoning Abilities of LLMs
ICLR 2025Rejected
三作5
Two-Step Offline Preference-Based Reinforcement Learning with Constrained Actions
ICLR 2025Withdrawn