影响力指数
论文质量、代表作、近期表现、广度与样本量置信度综合计算
64.83/100
前 3.6%
全站排名 #2,321
发表论文13 篇
平均评分
年均产出6.5 篇/年
Shuang Qiu
研究方向
Reinforcement Learning · Large Language Models · Stochastic Optimization
17
Model-based Offline RL via Robust Value-Aware Model Learning with Implicitly Differentiable Adaptive Weighting
ICLR 2026Poster
通讯22
FedPOB: Sample-Efficient Federated Prompt Optimization via Bandits
ICLR 2026Desk Rejected
16
Dual-Robust Cross-Domain Offline Reinforcement Learning Against Dynamics Shifts
ICLR 2026Poster
通讯17
Cross-domain Offline Policy Adaptation with Dynamics- and Value-aligned Data Filtering
ICLR 2026Rejected
通讯5
Self-Reflective Generation at Test Time
ICLR 2026Withdrawn
5
General Risk Measure meets Offline RL: Provably Efficient Risk-Sensitive Offline RL via Optimized Certainty Equivalent
ICLR 2026Withdrawn
通讯26
T-POP: Test-Time Personalization with Online Preference Feedback
ICLR 2026Rejected
15
Online Preference Alignment for Language Models via Count-based Exploration
ICLR 2025Spotlight
三作24
Segment Policy Optimization: Effective Segment-Level Credit Assignment in RL for Large Language Models
NeurIPS 2025Poster
通讯11
ROPO: Robust Preference Optimization for Large Language Models
ICML 2025Poster
三作28
Tackling Data Corruption in Offline Reinforcement Learning via Sequence Modeling
ICLR 2025Poster
三作28
Revisiting Multi-Agent World Modeling from a Diffusion-Inspired Perspective
NeurIPS 2025Poster
8
ROPO: Robust Preference Optimization for Large Language Models
ICLR 2025Rejected
三作