影响力指数
论文质量、代表作、近期表现、广度与样本量置信度综合计算
1.23/100
超过 2.8%
全站排名 #62,558
发表论文5 篇
平均评分
年均产出2.5 篇/年
32
Mesa and Mask: A Benchmark for Detecting and Classifying Deceptive Behaviors in LLMs
ICLR 2026Rejected
16
Beyond Refusals: Fine-grained Safety Alignment for Reasoning LLMs
ICLR 2026Rejected
一作15
Beyond Safe Answers: A Benchmark for Evaluating True Risk Awareness in Large Reasoning Models
ICLR 2026Rejected
5
USB: A Comprehensive and Unified Safety Evaluation Benchmark for Multimodal Large Language Models
ICLR 2026Withdrawn