影响力指数
论文质量、代表作、近期表现、广度与样本量置信度综合计算
81.36/100
前 1.3%
全站排名 #808
发表论文30 篇
平均评分
年均产出10.0 篇/年
Jiaya Jia
Full Professor@Department of Computer Science and Engineering, Hong Kong University of Science and Technology·中国香港·OpenReview
研究方向
Deep learning · Segmentation
43
Scaf-GRPO: Scaffolded Group Relative Policy Optimization for Enhancing LLM Reasoning
ICLR 2026Poster
通讯34
Stratified GRPO: Handling Structural Heterogeneity in Reinforcement Learning of LLM Search Agents
ICLR 2026Rejected
通讯25
VisionReasoner: Unified Reasoning-Integrated Visual Perception via Reinforcement Learning
ICLR 2026Poster
通讯21
RePlan: Reasoning-Guided Region Planning for Complex Instruction-Based Image Editing
ICLR 2026Rejected
通讯4
DreamOmni2: Multimodal Instruction-based Editing and Generation
ICLR 2026Withdrawn
通讯6
Guided Sampling in Reinforcement Learning for LLM Reasoning
ICLR 2026Rejected
三作6
From Noisy Traces to Stable Gradients: Bias--Variance Optimized Preference Optimization for Aligning Large Reasoning Models
ICLR 2026Rejected
通讯6
SmartSwitch: Advancing LLM Reasoning by Overcoming Underthinking via Promoting Deeper Thought Exploration
ICLR 2026Rejected
通讯5
Elevating Large Language Models with Module-of-Thought
ICLR 2026Withdrawn
通讯5
MGM-Omni: Scaling Omni LLMs to Personalized Long-Horizon Speech
ICLR 2026Withdrawn
通讯5
Don’t Lose the Thread: Empowering Long-Horizon LLM Agents with Cognitive Resource Self-Allocation
ICLR 2026Withdrawn
通讯5
DynamicBench: Evaluating Real-Time Report Generation in Large Language Models
ICLR 2026Withdrawn
通讯5
Multi-Scale Group Relative Policy Optimization for Large Language Models
ICLR 2026Withdrawn
通讯5
End-to-End QA Construction Pipeline for Continual Pre-training of Large Language Models
ICLR 2026Withdrawn
通讯5
IndustryGPT: A Large Language Model for Industrial Domain-Specific Question Answering
ICLR 2026Withdrawn
通讯42
VisionThink: Smart and Efficient Vision Language Model via Reinforcement Learning
NeurIPS 2025Poster
通讯28
Training-Free Efficient Video Generation via Dynamic Token Carving
NeurIPS 2025Poster
通讯15
GRADEO: Towards Human-Like Evaluation for Text-to-Video Generation via Multi-Step Reasoning
ICML 2025Poster
通讯40
DLoFT: Gradient-Decoupled Fine-Tuning for Generalizable Long Chain-of-Thought Reasoning
NeurIPS 2025Poster
通讯17
MR-GSM8K: A Meta-Reasoning Benchmark for Large Language Model Evaluation
ICLR 2025Poster
通讯5
Mini-Gemini: Mining the Potential of Multi-modality Vision Language Models
ICLR 2025Withdrawn
通讯13
TGDPO: Harnessing Token-Level Reward Guidance for Enhancing Direct Preference Optimization
ICML 2025Poster
通讯21
Effective LLM Knowledge Learning Requires Rethinking Generalization
ICLR 2025Rejected
通讯8
Step-DPO: Step-wise Preference Optimization for Long-chain Reasoning of LLMs
ICLR 2025Rejected
通讯