Paper
Hub
学术助手
数据洞察
排行榜
获奖论文
搜索
Toggle language
影响力指数
论文质量、代表作、近期表现、广度与样本量置信度综合计算
50.43
/100
前 8.4%
全站排名 #5,399
发表论文
4
篇
平均评分
6.2
年均产出
2.0
篇/年
Rico Angell
Postdoc
@
New York University
·
美国
·
OpenReview
研究方向
Machine Learning · Optimization · AI Safety · AI Alignment
发表论文
4
合作网络
学术分析
2026
3 篇
ICLR
NeurIPS
评分
7.5
20
Is it Thinking or Cheating? Detecting Implicit Reward Hacking by Measuring Reasoning Effort
ICLR 2026
Oral
6.5
16
Jailbreak Transferability Emerges from Shared Representations
ICLR 2026
Poster
一作
4.5
32
Monitoring Decomposition Attacks with Lightweight Sequential Monitors
ICLR 2026
Poster
2024
1 篇
6.3
14
Measuring Progress in Dictionary Learning for Language Model Interpretability with Board Game Models
NeurIPS 2024
Poster
合作者 (15)
HH
He He
博后导师
3 篇
NJ
Nitish Joshi
2 篇
JB
Jannik Brinkmann
2 篇
BP
Barbara Plank
1 篇
XW
Xinpeng Wang
1 篇
CY
Chen Yueh-Han
1 篇
MA
Maksym Andriushchenko
1 篇
YC
Yulin Chen
1 篇
查看全部 15 位合作者