影响力指数
论文质量、代表作、近期表现、广度与样本量置信度综合计算
71.33/100
前 2.4%
全站排名 #1,546
发表论文12 篇
平均评分
年均产出6.0 篇/年
Shangtong Zhang
研究方向
Lean · stochastic approximation · reinforcement learning
17
Reward Is Enough: LLMs Are In-Context Reinforcement Learners
ICLR 2026Poster
12
The Stability and Convergence of Two-Timescale Stochastic Approximation with Markovian Noise for Reinforcement Learning
ICLR 2026Rejected
通讯21
Efficient and Robust Behavior Policy Search for Online Off-policy Evaluation through Transition Gradients
ICLR 2026Rejected
通讯12
Safe In-Context Reinforcement Learning
ICLR 2026Rejected
通讯20
Finite Sample Analysis of Linear Temporal Difference Learning with Arbitrary Features
NeurIPS 2025Poster
通讯10
Linear $Q$-Learning Does Not Diverge in $L^2$: Convergence Rates to a Bounded Set
ICML 2025Poster
三作20
Efficient Policy Evaluation with Safety Constraint for Reinforcement Learning
ICLR 2025Poster
三作20
Revisiting a Design Choice in Gradient Temporal Difference Learning
ICLR 2025Poster
二作20
Transformers Can Learn Temporal Difference Methods for In-Context Reinforcement Learning
ICLR 2025Poster
通讯26
Towards Provable Emergence of In-Context Reinforcement Learning
NeurIPS 2025Poster
三作16
Doubly Optimal Policy Evaluation for Reinforcement Learning
ICLR 2025Poster
三作31
Almost Sure Convergence of Average Reward Temporal Difference Learning
ICLR 2025Rejected
二作