影响力指数
论文质量、代表作、近期表现、广度与样本量置信度综合计算
72.96/100
前 2.2%
全站排名 #1,398
发表论文15 篇
平均评分
年均产出5.0 篇/年
Zhang-Wei Hong
研究方向
Reinforcement learning
19
A Reward-Free Viewpoint on Multi-Objective Reinforcement Learning
ICLR 2026Poster
20
BOAD: Discovering Hierarchical Software Engineering Agents via Bandit Optimization
ICLR 2026Poster
通讯23
Composition-Grounded Data Synthesis for Visual Reasoning
ICLR 2026Poster
三作16
EvoScale: Evolutionary Test-Time Scaling for Software Engineering
ICLR 2026Rejected
5
Tailored Primitive Initialization is the Secret Key to Reinforcement Learning
ICLR 2026Withdrawn
12
Large Pretraining Datasets Don't Guarantee Robustness after Fine-Tuning
ICLR 2026Rejected
三作18
GPTOpt: Towards Efficient LLM-based Black-Box Optimization
ICLR 2026Rejected
21
RL Tango: Reinforcing Generator and Verifier Together for Language Reasoning
NeurIPS 2025Poster
44
ORSO: Accelerating Reward Design via Online Reward Selection and Policy Optimization
ICLR 2025Poster
二作10
Satori: Reinforcement Learning with Chain-of-Action-Thought Enhances LLM Reasoning via Autoregressive Search
ICML 2025Poster
34
ReGen: Generative Robot Simulation via Inverse Design
ICLR 2025Poster
三作30
ImageNet-RIB Benchmark: Large Pre-Training Datasets Don't Guarantee Robustness after Fine-Tuning
ICLR 2025Rejected
三作