Paper
Hub
学术助手
数据洞察
排行榜
获奖论文
搜索
Toggle language
影响力指数
论文质量、代表作、近期表现、广度与样本量置信度综合计算
-
/100
发表论文
2
篇
平均评分
5.3
年均产出
1.0
篇/年
Hiteshi Sharma
Researcher
@
Microsoft
·
OpenReview
研究方向
Markov decision processes · reinforcement learning · bandits
发表论文
2
合作网络
学术分析
2025
1 篇
评分
-
1
Self-Exploring Language Models: Active Preference Elicitation for Online Alignment
ICLR 2025
Withdrawn
三作
2024
1 篇
5.3
15
Fine-Tuning Language Models with Advantage-Induced Policy Alignment
ICLR 2024
Rejected
二作
合作者 (14)
DY
Donghan Yu
1 篇
HZ
Han Zhong
1 篇
HA
Hany Hassan Awadalla
1 篇
SZ
Shenao Zhang
1 篇
SW
Shuohang Wang
1 篇
ZW
Zhaoran Wang
1 篇
ZL
Zhihan Liu
1 篇
ZY
Ziyi Yang
1 篇
查看全部 14 位合作者