影响力指数
94.15/100
前 0.3%
全站排名 #203
发表论文38
平均评分5.4
年均产出12.7 篇/年

Yang Gao

Full Professor@Nanjing University·中国·OpenReview
研究方向

reinforement learning · multi-agent systems

6.0
21

Retain and Adapt: Auto-Balanced Model Editing for Open-Vocabulary Object Detection under Domain Shifts

ICLR 2026Poster
5.5
18

QPrompt-R1: Real-Time Reasoning for Domain-Generalized Semantic Segmentation via Group-Relative Query Alignment

ICLR 2026Poster
5.5
16

A Faster Parameter-Free Regret Matching Algorithm

ICLR 2026Poster
通讯
5.0
27

Distractor-free Generalizable 3D Gaussian Splatting

ICLR 2026Poster
通讯
5.0
21

Macro-from-Micro Planning for High-Quality and Parallelized Autoregressive Long Video Generation

ICLR 2026Rejected
4.7
20

SpatialComposer: 3D Spatial Object Insertion via Image Gaussian Composition

ICLR 2026Rejected
通讯
4.5
5

HERA: Efficient Test-Time Adaptation for Cross-Domain Few-Shot Segmentation with Vision Foundation Models

ICLR 2026Withdrawn
4.5
34

MedSentry: Understanding and Mitigating Safety Risks in Medical LLM Multi-Agent Systems

ICLR 2026Rejected
通讯
4.5
31

SafeDialBench: A Fine-Grained Safety Evaluation Benchmark for Large Language Models in Multi-Turn Dialogues with Diverse Jailbreak Attacks

ICLR 2026Poster
4.0
5

Identity-Preserving Human Reconstruction from a Single Image via Explicit 3D Reasoning

ICLR 2026Withdrawn
三作
4.0
5

Finding Harmony in Chemical Data: Hierarchical and Balanced multimodal Fusion for Reaction Yield Prediction

ICLR 2026Withdrawn
4.0
21

SmartSAM: Segment Ambiguous Objects like Smart Annotators

ICLR 2026Rejected
4.0
5

VITA-VLA: Efficiently Teaching Vision-Language Models to Act via Action Expert Distillation

ICLR 2026Withdrawn
4.0
5

MASLab: A Unified and Comprehensive Codebase for LLM-based Multi-Agent Systems

ICLR 2026Withdrawn
3.5
5

RoboHiMan: A Hierarchical Evaluation Paradigm for Compositional Generalization in Long-Horizon Manipulation

ICLR 2026Withdrawn
2.5
13

DGPO: Mitigating Likelihood Displacement with Bidirectional KL Divergence Gap

ICLR 2026Rejected
8.2
21

DON’T NEED RETRAINING: A Mixture of DETR and Vision Foundation Models for Cross-Domain Few-Shot Object Detection

NeurIPS 2025Poster
通讯
7.2
10

Reducing Variance of Stochastic Optimization for Approximating Nash Equilibria in Normal-Form Games

ICML 2025Spotlight
通讯
7.0
38

Leveraging Flatness to Improve Information-Theoretic Generalization Bounds for SGD

ICLR 2025Poster
通讯
6.8
22

Federated Multi-armed Bandits with Efficient Bit-Level Communications

NeurIPS 2025Poster
通讯
6.8
22

Multi-Agent Reinforcement Learning with Communication-Constrained Priors

NeurIPS 2025Poster
通讯
6.8
32

Efficient Last-Iterate Convergence in Solving Extensive-Form Games

NeurIPS 2025Poster
通讯
6.4
31

In-Context Fully Decentralized Cooperative Multi-Agent Reinforcement Learning

NeurIPS 2025Poster
三作
6.4
31

Combinatorial Ski Rental Problem: Robust and Learning-Augmented Algorithms

NeurIPS 2025Poster
通讯
6.4
33

Last-Iterate Convergence of Smooth Regret Matching$^+$ Variants in Learning Nash Equilibria

NeurIPS 2025Poster
通讯
6.3
23

Causal Information Prioritization for Efficient Reinforcement Learning

ICLR 2025Poster
通讯
6.2
36

Towards Empowerment Gain through Causal Structure Learning in Model-Based Reinforcement Learning

ICLR 2025Poster
通讯
6.0
40

GravMAD: Grounded Spatial Value Maps Guided Action Diffusion for Generalized 3D Manipulation

ICLR 2025Poster
通讯
6.0
17

Last-Iterate Convergence of Smooth Regret Matching$^+$ Variants in Learning Nash Equilibria

ICLR 2025Rejected
通讯
4.8
7

Adapting Informative Structures for Cross-Domain Few-Shot Segmentation

ICLR 2025Withdrawn
通讯
4.0
6

Efficient Predictive Counterfactual Regret Minimization$^+$ Algorithm in Solving Extensive-Form Games

ICLR 2025Rejected
通讯
4.0
15

Enhancing Trust-Region Bayesian Optimization via Derivatives of Gaussian Processes

ICLR 2025Withdrawn
3.8
32

Learning Nash Equilibria in Normal-Form Games via Approximating Stationary Points

ICLR 2025Rejected
通讯