影响力指数
论文质量、代表作、近期表现、广度与样本量置信度综合计算
64.45/100
前 3.7%
全站排名 #2,370
发表论文8 篇
平均评分
年均产出2.7 篇/年
Zhaolin Gao
研究方向
Reinforcement Learning · Natural Language Processing · Information Retrieval
9
$Q\sharp$: Provably Optimal Distributional RL for LLM Post-Training
ICML 2025Rejected
20
Accelerating RL for LLM Reasoning with Optimal Advantage Regression
NeurIPS 2025Poster
三作22
$Q\sharp$: Provably Optimal Distributional RL for LLM Post-Training
NeurIPS 2025Poster
19
Value-Guided Search for Efficient Chain-of-Thought Reasoning
NeurIPS 2025Poster
11
Regressing the Relative Future: Efficient Policy Optimization for Multi-turn RLHF
ICLR 2025Poster
一作31
Pre-trained Large Language Models Learn to Predict Hidden Markov Models In-context
NeurIPS 2025Poster
二作