影响力指数
论文质量、代表作、近期表现、广度与样本量置信度综合计算
94.98/100
前 0.3%
全站排名 #172
发表论文33 篇
平均评分
年均产出11.0 篇/年
10
RewardBench 2: Advancing Reward Model Evaluation
ICLR 2026Poster
17
LEGATO: Large-scale End-to-end Generalizable Approach to Typeset OMR
ICLR 2026Poster
通讯29
MMMG: A Comprehensive and Reliable Benchmark for Multitask Multimodal Generation
ICLR 2026Rejected
5
PointArena: Probing Multimodal Grounding Through Language-Guided Pointing
ICLR 2026Withdrawn
12
BLAB: Brutally Long Audio Bench
ICLR 2026Rejected
19
Sample, Don't Search: Rethinking Test-Time Alignment for Language Models
ICLR 2026Rejected
二作15
Sampling from Your Language Model One Byte at a Time
ICLR 2026Rejected
三作6
Are you going to finish that? A Practical Study of the Tokenization Boundary Problem
ICLR 2026Rejected
通讯26
FlexOLMo: Open Language Models for Flexible Data Use
NeurIPS 2025Spotlight
13
OLMoE: Open Mixture-of-Experts Language Models
ICLR 2025Oral
11
SuperBPE: Space Travel for Language Models
COLM 2025Poster
11
Tulu 3: Pushing Frontiers in Open Language Model Post-Training
COLM 2025Poster
19
Signal and Noise: A Framework for Reducing Uncertainty in Language Model Evaluation
NeurIPS 2025Spotlight
18
Broken Tokens? Your Language Model can Secretly Handle Non-Canonical Tokenizations
NeurIPS 2025Spotlight
通讯8
Fluid Language Model Benchmarking
COLM 2025Poster
通讯10
2 OLMo 2 Furious (COLM’s Version)
COLM 2025Poster
13
Establishing Task Scaling Laws via Compute-Efficient Model Ladders
COLM 2025Poster
7
DataDecide: How to Predict Best Pretraining Data with Small Experiments
ICML 2025Poster
23
MUSE: Machine Unlearning Six-Way Evaluation for Language Models
ICLR 2025Poster
22
On Linear Representations and Pretraining Data Frequency in Language Models
ICLR 2025Poster
二作12
Hybrid Preferences: Learning to Route Instances for Human vs. AI Feedback
ICLR 2025Rejected