影响力指数
论文质量、代表作、近期表现、广度与样本量置信度综合计算
45.23/100
前 10.8%
全站排名 #6,974
发表论文7 篇
平均评分
年均产出3.5 篇/年
Chen Bo Calvin Zhang
研究方向
Reinforcement Learning · Benchmarking and Evals · Safety and Alignement
18
Reliable Weak-to-Strong Monitoring of LLM Agents
ICLR 2026Oral
二作24
MoReBench: Evaluating Procedural and Pluralistic Moral Reasoning in Language Models, More than Outcomes
ICLR 2026Poster
12
ResearchRubrics: A Benchmark of Prompts and Rubrics For Evaluating Deep Research Agents
ICLR 2026Poster
二作21
Beyond Seeing: Evaluating Multimodal LLMs on Tool-Enabled Image Perception, Transformation, and Reasoning
ICLR 2026Rejected
18
SWE-Bench Pro: Can AI Agents Solve Long-Horizon Software Engineering Tasks?
ICLR 2026Rejected
5
TutorBench: A Benchmark To Assess Tutoring Capabilities Of Large Language Models
ICLR 2026Withdrawn
三作