影响力指数
论文质量、代表作、近期表现、广度与样本量置信度综合计算
69.26/100
前 2.8%
全站排名 #1,785
发表论文30 篇
平均评分
年均产出10.0 篇/年
Jian Yang
研究方向
Common Large Language Model & Code Large Language Model · Multilingual Pretrain & Understanding & Generation · Machine translation
11
YuE: Scaling Open Foundation Models for Long-Form Music Generation
ICLR 2026Poster
19
TaskCraft: Automated Generation of Agentic Tasks
ICLR 2026Poster
13
TreePO: Enhancing Policy Efficacy and Inference Efficiency with Tree Modeling
ICLR 2026Rejected
19
BiasScope: Towards Automated Detection of Bias in LLM-as-a-Judge Evaluation
ICLR 2026Poster
21
P2P: Automated Paper-to-Poster Generation and Fine-Grained Benchmark
ICLR 2026Poster
33
A$^2$FM: An Adaptive Agent Foundation Model for Tool-Aware Hybrid Reasoning
ICLR 2026Poster
18
Chain-of-Agents: End-to-End Agent Foundation Models via Multi-Agent Distillation and Agentic RL
ICLR 2026Rejected
44
OmniVideoBench: Towards Audio-Visual Understanding Evaluation for Omni MLLMs
ICLR 2026Poster
14
Scale-Distribution Decoupling: Enabling Stable and Effective Training of Large Language Models
ICLR 2026Rejected
17
MM-BrowseComp: A Comprehensive Benchmark for Multimodal Browsing Agents
ICLR 2026Withdrawn
15
Beyond Safe Answers: A Benchmark for Evaluating True Risk Awareness in Large Reasoning Models
ICLR 2026Rejected
5
CryptoX : Compositional Reasoning Evaluation of Large Language Models
ICLR 2026Withdrawn
30
Scaling Laws for Online Advertisement Retrieval
ICLR 2026Rejected
5
Steering Merged LLMs for Multilingual Reasoning with Coefficient Optimization
ICLR 2026Withdrawn
5
USB: A Comprehensive and Unified Safety Evaluation Benchmark for Multimodal Large Language Models
ICLR 2026Withdrawn
5
Reinforcement Learning for Symbolic Graphics Code with Visual Feedback
ICLR 2026Withdrawn
19
KORGym: A Dynamic Game Platform for LLM Reasoning Evaluation
NeurIPS 2025Spotlight
二作29
KOR-Bench: Benchmarking Language Models on Knowledge-Orthogonal Reasoning Tasks
ICLR 2025Poster
9
Learning Cascade Ranking as One Network
ICML 2025Poster
22
McEval: Massively Multilingual Code Evaluation
ICLR 2025Poster
三作19
HybridNorm: Towards Stable and Efficient Transformer Training via Hybrid Normalization
NeurIPS 2025Poster
9
Synthesizing Software Engineering Data in a Test-Driven Manner
ICML 2025Poster
26
LIME: LESS IS MORE FOR MLLM EVALUATION
ICLR 2025Rejected
19
OmniBench: Towards The Future of Universal Omni-Language Models
ICLR 2025Rejected
37
M2rc-Eval: Massively Multilingual Repository-level Code Completion Evaluation
ICLR 2025Rejected
32
AutoKaggle: A Multi-Agent Framework for Autonomous Data Science Competitions
ICLR 2025Rejected
20
HelloBench: Evaluating Long Text Generation Capabilities of Large Language Models
ICLR 2025Withdrawn
6
CodeChain: An Open, Million-scale Dataset for Code Language Models at the Repository Level
ICLR 2025Withdrawn
三作5
RepoFixEval: A Repository-Level Program Repair Benchmark From Issue Discovering to Bug Fixing
ICLR 2025Withdrawn