Paper
Hub
学术助手
数据洞察
排行榜
获奖论文
搜索
Toggle language
影响力指数
论文质量、代表作、近期表现、广度与样本量置信度综合计算
35.63
/100
前 18.2%
全站排名 #11,747
发表论文
4
篇
平均评分
5.5
年均产出
2.0
篇/年
Niels Warncke
Researcher
@
Center on Long-Term Risk
·
英国
·
OpenReview
研究方向
Machine Learning
发表论文
4
合作网络
学术分析
2026
2 篇
ICLR
ICML
已接收
未接收
评分
5.0
13
Inoculation Prompting: Eliciting traits from LLMs during training can reduce trait expression at test-time
ICLR 2026
Poster
三作
4.5
10
Strategic Obfuscation of Deceptive Reasoning in Language Models
ICLR 2026
Poster
二作
2025
2 篇
8.3
11
Emergent Misalignment: Narrow finetuning can produce broadly misaligned LLMs
ICML 2025
Oral
三作
4.0
6
Plan B: Training LLMs to fail less severely
ICLR 2025
Withdrawn
二作
合作者 (19)
AJ
Arun Jose
2 篇
MT
Mia Taylor
2 篇
AS
Anna Sztyber-Betley
合作者
1 篇
DT
Daniel Chee Hian Tan
合作者
1 篇
JB
Jan Betley
合作者
1 篇
MS
Martín Soto
合作者
1 篇
NL
Nathan Labenz
合作者
1 篇
OE
Owain Evans
合作者
1 篇
查看全部 19 位合作者