影响力指数
论文质量、代表作、近期表现、广度与样本量置信度综合计算
94.15/100
前 0.3%
全站排名 #203
发表论文38 篇
平均评分
年均产出12.7 篇/年
Yang Gao
研究方向
reinforement learning · multi-agent systems
21
Retain and Adapt: Auto-Balanced Model Editing for Open-Vocabulary Object Detection under Domain Shifts
ICLR 2026Poster
18
QPrompt-R1: Real-Time Reasoning for Domain-Generalized Semantic Segmentation via Group-Relative Query Alignment
ICLR 2026Poster
16
A Faster Parameter-Free Regret Matching Algorithm
ICLR 2026Poster
通讯27
Distractor-free Generalizable 3D Gaussian Splatting
ICLR 2026Poster
通讯21
Macro-from-Micro Planning for High-Quality and Parallelized Autoregressive Long Video Generation
ICLR 2026Rejected
20
SpatialComposer: 3D Spatial Object Insertion via Image Gaussian Composition
ICLR 2026Rejected
通讯5
HERA: Efficient Test-Time Adaptation for Cross-Domain Few-Shot Segmentation with Vision Foundation Models
ICLR 2026Withdrawn
34
MedSentry: Understanding and Mitigating Safety Risks in Medical LLM Multi-Agent Systems
ICLR 2026Rejected
通讯31
SafeDialBench: A Fine-Grained Safety Evaluation Benchmark for Large Language Models in Multi-Turn Dialogues with Diverse Jailbreak Attacks
ICLR 2026Poster
5
Identity-Preserving Human Reconstruction from a Single Image via Explicit 3D Reasoning
ICLR 2026Withdrawn
三作5
Finding Harmony in Chemical Data: Hierarchical and Balanced multimodal Fusion for Reaction Yield Prediction
ICLR 2026Withdrawn
21
SmartSAM: Segment Ambiguous Objects like Smart Annotators
ICLR 2026Rejected
5
VITA-VLA: Efficiently Teaching Vision-Language Models to Act via Action Expert Distillation
ICLR 2026Withdrawn
5
MASLab: A Unified and Comprehensive Codebase for LLM-based Multi-Agent Systems
ICLR 2026Withdrawn
5
RoboHiMan: A Hierarchical Evaluation Paradigm for Compositional Generalization in Long-Horizon Manipulation
ICLR 2026Withdrawn
13
DGPO: Mitigating Likelihood Displacement with Bidirectional KL Divergence Gap
ICLR 2026Rejected
21
DON’T NEED RETRAINING: A Mixture of DETR and Vision Foundation Models for Cross-Domain Few-Shot Object Detection
NeurIPS 2025Poster
通讯10
Reducing Variance of Stochastic Optimization for Approximating Nash Equilibria in Normal-Form Games
ICML 2025Spotlight
通讯38
Leveraging Flatness to Improve Information-Theoretic Generalization Bounds for SGD
ICLR 2025Poster
通讯22
Federated Multi-armed Bandits with Efficient Bit-Level Communications
NeurIPS 2025Poster
通讯22
Multi-Agent Reinforcement Learning with Communication-Constrained Priors
NeurIPS 2025Poster
通讯32
Efficient Last-Iterate Convergence in Solving Extensive-Form Games
NeurIPS 2025Poster
通讯31
In-Context Fully Decentralized Cooperative Multi-Agent Reinforcement Learning
NeurIPS 2025Poster
三作31
Combinatorial Ski Rental Problem: Robust and Learning-Augmented Algorithms
NeurIPS 2025Poster
通讯33
Last-Iterate Convergence of Smooth Regret Matching$^+$ Variants in Learning Nash Equilibria
NeurIPS 2025Poster
通讯23
Causal Information Prioritization for Efficient Reinforcement Learning
ICLR 2025Poster
通讯36
Towards Empowerment Gain through Causal Structure Learning in Model-Based Reinforcement Learning
ICLR 2025Poster
通讯40
GravMAD: Grounded Spatial Value Maps Guided Action Diffusion for Generalized 3D Manipulation
ICLR 2025Poster
通讯17
Last-Iterate Convergence of Smooth Regret Matching$^+$ Variants in Learning Nash Equilibria
ICLR 2025Rejected
通讯7
Adapting Informative Structures for Cross-Domain Few-Shot Segmentation
ICLR 2025Withdrawn
通讯6
Efficient Predictive Counterfactual Regret Minimization$^+$ Algorithm in Solving Extensive-Form Games
ICLR 2025Rejected
通讯15
Enhancing Trust-Region Bayesian Optimization via Derivatives of Gaussian Processes
ICLR 2025Withdrawn
32
Learning Nash Equilibria in Normal-Form Games via Approximating Stationary Points
ICLR 2025Rejected
通讯