影响力指数
论文质量、代表作、近期表现、广度与样本量置信度综合计算
96.86/100
前 0.2%
全站排名 #102
发表论文53 篇
平均评分
年均产出17.7 篇/年
Yang Yu
研究方向
reinforcement learning · derivative-free optimization · ensemble learning
10
A Study on PAVE Specification for Learnware
ICLR 2026Poster
19
ADM-v2: Pursuing Full-Horizon Roll-out in Dynamics Models for Offline Policy Learning and Evaluation
ICLR 2026Poster
通讯24
Hierarchical Value-Decomposed Offline Reinforcement Learning for Whole-Body Control
ICLR 2026Poster
通讯18
Off-Policy Token Clipped Supervised Fine-Tuning Yields a Robust Cold-Start
ICLR 2026Rejected
通讯20
On the Representation Degradation in Vision-Language-Action Models
ICLR 2026Rejected
通讯16
EMFuse: Energy-based Model Fusion for Decision Making
ICLR 2026Poster
三作19
MiniOpt: Reasoning to Model and Solve General Optimization Problems with Limited Resources
ICLR 2026Withdrawn
通讯15
MOBA: Model-Based Offline Reinforcement Learning with Adaptive Contextual Penalties
ICLR 2026Rejected
三作31
Provably Efficient Policy-Reward Co-Pretraining for Adversarial Imitation Learning
ICLR 2026Rejected
通讯19
Planning with Unified Multimodal Models
ICLR 2026Rejected
三作5
Proactive Cost Generation for Offline Safe Reinforcement Learning Without Unsafe Data
ICLR 2026Withdrawn
通讯13
Learning Disentangled Multi-Agent World Model for Decentralized Control
ICLR 2026Withdrawn
通讯5
ReLAM: Learning Anticipation Model for Rewarding Visual Robotic Manipulation
ICLR 2026Withdrawn
通讯5
ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts
ICLR 2026Withdrawn
通讯6
Long CoT In-Context Learning Can Empower Pre-trained LLMs
ICLR 2026Rejected
通讯20
Focus-Then-Reuse: Fast Adaptation in Visual Perturbation Environments
NeurIPS 2025Poster
通讯19
Adaptable Safe Policy Learning from Multi-task Data with Constraint Prioritized Decision Transformer
NeurIPS 2025Poster
通讯13
LLM-Assisted Semantically Diverse Teammate Generation for Efficient Multi-agent Coordination
ICML 2025Poster
通讯32
Efficient Multi-agent Offline Coordination via Diffusion-based Trajectory Stitching
ICLR 2025Poster
通讯25
Uncertainty-Sensitive Privileged Learning
NeurIPS 2025Poster
三作26
On the Optimization Landscape of Low Rank Adaptation Methods for Large Language Models
ICLR 2025Poster
通讯9
Behavior-Regularized Diffusion Policy Optimization for Offline Reinforcement Learning
ICML 2025Poster
14
Semantic Temporal Abstraction via Vision-Language Model Guidance for Efficient Reinforcement Learning
ICLR 2025Poster
通讯16
Q-Adapter: Customizing Pre-trained LLMs to New Preferences with Forgetting Mitigation
ICLR 2025Poster
8
Any-step Dynamics Model Improves Future Predictions for Online and Offline Reinforcement Learning
ICLR 2025Poster
通讯36
SOO-Bench: Benchmarks for Evaluating the Stability of Offline Black-Box Optimization
ICLR 2025Poster
通讯37
Safe Multi-task Pretraining with Constraint Prioritized Decision Transformer
ICLR 2025Rejected
通讯13
Improving Reward Model Generalization from Adversarial Process Enhanced Preferences
ICML 2025Poster
通讯62
LLMOPT: Learning to Define and Solve General Optimization Problems from Scratch
ICLR 2025Poster
通讯7
Controlling Large Language Model with Latent Action
ICML 2025Poster
通讯26
Multi-Agent Imitation by Learning and Sampling from Factorized Soft Q-Function
NeurIPS 2025Poster
通讯7
Learning to Reuse Policies in State Evolvable Environments
ICML 2025Poster
通讯30
Learning View-invariant World Models for Visual Robotic Manipulation
ICLR 2025Poster
通讯19
Hindsight Preference Learning for Offline Preference-based Reinforcement Learning
ICLR 2025Rejected
7
Haland: Human-AI Coordination via Policy Generation from Language-guided Diffusion
ICLR 2025Rejected
通讯4
Boosting Offline Multi-Objective Reinforcement Learning via Preference Conditioned Diffusion Models
ICLR 2025Withdrawn
通讯9
Learning Generalizable Environment Models via Discovering Superposed Causal Relationships
ICLR 2025Rejected
5
Diffusion-Guided Safe Policy Optimization From Cost-Label-Free Offline Dataset
ICLR 2025Withdrawn
通讯-1
Whale-X: Learning Scalable Embodied World Models with Enhanced Generalizability
ICLR 2025Withdrawn
通讯