Paper
Hub
学术助手
数据洞察
排行榜
获奖论文
搜索
Toggle language
影响力指数
论文质量、代表作、近期表现、广度与样本量置信度综合计算
9.95
/100
超过 31%
全站排名 #44,440
发表论文
1
篇
平均评分
5.7
年均产出
1.0
篇/年
Tong Mu
Researcher
@
OpenAI
·
OpenReview
研究方向
Reinforcement Learning · LLM Safety
发表论文
1
合作网络
学术分析
2024
1 篇
评分
5.7
12
Rule Based Rewards for Language Model Safety
NeurIPS 2024
Poster
一作
合作者 (9)
AH
Alec Helyar
1 篇
AB
Alex Beutel
1 篇
AV
Andrea Vallone
1 篇
IK
Ian D Kivlichan
1 篇
JH
Johannes Heidecke
1 篇
JS
John Schulman
1 篇
JA
Joshua Achiam
1 篇
LW
Lilian Weng
1 篇
查看全部 9 位合作者