Paper
Hub
学术助手
数据洞察
排行榜
获奖论文
搜索
Toggle language
影响力指数
论文质量、代表作、近期表现、广度与样本量置信度综合计算
11.05
/100
超过 34.3%
全站排名 #42,313
发表论文
1
篇
平均评分
6.1
年均产出
1.0
篇/年
Zikang Shan
PhD student
@
Peking University
·
中国
·
OpenReview
研究方向
reinforcement learning
发表论文
1
合作网络
学术分析
2025
1 篇
评分
6.1
11
DPO Meets PPO: Reinforced Token Optimization for RLHF
ICML 2025
Spotlight
二作
合作者 (8)
DH
Di He
1 篇
GF
Guhao Feng
1 篇
HZ
Han Zhong
1 篇
JB
Jiang Bian
1 篇
LZ
Li Zhao
1 篇
LW
Liwei Wang
1 篇
WX
Wei Xiong
1 篇
XC
Xinle Cheng
1 篇