影响力指数
论文质量、代表作、近期表现、广度与样本量置信度综合计算
56.4/100
前 5.9%
全站排名 #3,814
发表论文13 篇
平均评分
年均产出4.3 篇/年
16
ThinkDial: An Open Recipe for Controlling Reasoning Effort in Large Language Models
ICLR 2026Rejected
二作19
Critique-RL: Training Language Models For Critiquing Through Two-Stage Reinforcement Learning
ICLR 2026Poster
16
OS-Catalyst: Advancing Computer-Using Agents Efficiency through Adaptive Action Compression
ICLR 2026Withdrawn
6
WAPITI: A Watermark for Finetuned Open-Source LLMs
ICLR 2026Rejected
三作19
KORGym: A Dynamic Game Platform for LLM Reasoning Evaluation
NeurIPS 2025Spotlight
22
ARIA: Training Language Agents with Intention-driven Reward Aggregation
NeurIPS 2025Spotlight
21
ORIGAMISPACE: Benchmarking Multimodal LLMs in Multi-Step Spatial Reasoning with Mathematical Constraints
NeurIPS 2025Spotlight
19
Enigmata: Scaling Logical Reasoning in Large Language Models with Synthetic Verifiable Puzzles
NeurIPS 2025Spotlight
三作35
The Lighthouse of Language: Enhancing LLM Agents via Critique-Guided Improvement
NeurIPS 2025Poster
7
CoSER: Coordinating LLM-Based Persona Simulation of Established Roles
ICML 2025Poster
18
WAPITI: A Watermark for Finetuned Open-Source LLMs
ICLR 2025Withdrawn
三作