影响力指数
论文质量、代表作、近期表现、广度与样本量置信度综合计算
86.74/100
前 0.8%
全站排名 #519
发表论文20 篇
平均评分
年均产出6.7 篇/年
Nan Jiang
研究方向
predictive state representation · reinforcement learning · state abstraction · markov decision processes · off-policy evaluation · pac · offline reinforcement learning · batch reinforcement learning
19
A Unifying View of Coverage in Linear Off-policy Evaluation
ICLR 2026Poster
通讯23
On the Tension Between Optimality and Adversarial Robustness in Policy Optimization
ICLR 2026Poster
通讯17
Multi-Level Regression for Nonlinear Contextual Bandits and RL: Second-order and Horizon-free Regret Bounds
ICLR 2026Rejected
二作21
Efficient and Robust Behavior Policy Search for Online Off-policy Evaluation through Transition Gradients
ICLR 2026Rejected
12
Softmax for Continuous Actions: Optimality, MCMC Sampling, and Actor-Free Control
ICLR 2026Rejected
三作23
A Snapshot of Influence: A Local Data Attribution Framework for Online Reinforcement Learning
NeurIPS 2025Oral
12
Optimizing Chain-of-Thought Reasoners via Gradient Variance Minimization in Rejection Sampling and RL
NeurIPS 2025Poster
22
Improving LLM General Preference Alignment via Optimistic Online Mirror Descent
NeurIPS 2025Spotlight
5
Is Best-of-N the Best of Them? Coverage, Scaling, and Optimality in Inference-Time Alignment
ICML 2025Poster
21
Thinking vs. Doing: Improving Agent Reasoning by Scaling Test-Time Interaction
NeurIPS 2025Poster
17
Statistical Tractability of Off-policy Evaluation of History-dependent Policies in POMDPs
ICLR 2025Poster
二作6
Iterative Nash Policy Optimization: Aligning LLMs with General Preferences via No-Regret Learning
ICLR 2025Oral
34
Model Selection for Off-policy Evaluation: New Algorithms and Experimental Protocol
NeurIPS 2025Poster
通讯13
Model Selection for Off-policy Evaluation: New Algorithms and Experimental Protocol
ICML 2025Rejected
通讯