影响力指数
论文质量、代表作、近期表现、广度与样本量置信度综合计算
16.2/100
超过 49%
全站排名 #32,805
发表论文4 篇
平均评分
年均产出2.0 篇/年
Phillip Huang Guo
研究方向
Adversarial Robustness · Large Language Models · Interpretability · Optimization
9
Mechanistic Unlearning: Robust Knowledge Unlearning and Editing via Mechanistic Localization
ICML 2025Spotlight
一作26
Mechanistic Unlearning: Robust Knowledge Unlearning and Editing via Mechanistic Localization
ICLR 2025Rejected
一作30
Latent Adversarial Training Improves Robustness to Persistent Harmful Behaviors in LLMs
ICLR 2025Rejected
三作