影响力指数
论文质量、代表作、近期表现、广度与样本量置信度综合计算
63.23/100
前 3.9%
全站排名 #2,530
发表论文10 篇
平均评分
年均产出3.3 篇/年
Tiansheng Huang
研究方向
ML safety · Federated learning
31
Booster: Tackling Harmful Fine-tuning for Large Language Models via Attenuating Harmful Perturbation
ICLR 2025Oral
一作28
Panacea: Mitigating Harmful Fine-tuning for Large Language Models via Post-fine-tuning Perturbation
NeurIPS 2025Poster
二作15
Antidote: Post-fine-tuning Safety Alignment for Large Language Models against Harmful Fine-tuning Attack
ICML 2025Poster
一作33
Probe before You Talk: Towards Black-box Defense against Backdoor Unalignment for Large Language Models
ICLR 2025Poster
二作27
PokéLLMon: A Grounding and Reasoning Benchmark for Large Language Models in Pokémon Battles
ICLR 2025Withdrawn
二作