影响力指数
论文质量、代表作、近期表现、广度与样本量置信度综合计算
14.01/100
超过 43%
全站排名 #36,727
发表论文7 篇
平均评分
年均产出7.0 篇/年
Aniruddha Saha
研究方向
Adversarial Machine Learning · Trustworthy Machine Learning · AI Security · AI Safety · Computer Vision
19
On the Reliability of Watermarks for Large Language Models
ICLR 2024Poster
14
Bring Your Own Data! Self-Sensitivity Evaluation for Large Language Models
COLM 2024Poster
25
NEFTune: Noisy Embeddings Improve Instruction Finetuning
ICLR 2024Poster
16
Baseline Defenses for Adversarial Attacks Against Aligned Language Models
ICLR 2024Rejected
10
Bring Your Own Data! Self-Supervised Evaluation for Large Language Models
ICLR 2024Withdrawn
18
Spotting LLMs With Binoculars: Zero-Shot Detection of Machine-Generated Text
ICLR 2024Rejected
4
Algorithm Design for Learned Algorithms
ICLR 2024Withdrawn