影响力指数
论文质量、代表作、近期表现、广度与样本量置信度综合计算
97.8/100
前 0.1%
全站排名 #63
发表论文39 篇
平均评分
年均产出13.0 篇/年
Bryan Catanzaro
研究方向
speech recognition · deep learning · machine learning systems
10
Nemotron-CC-Math: A 133 Billion-Token-Scale High Quality Math Pretraining Dataset
ICLR 2026Poster
通讯13
AceReason-Nemotron 1.1: Advancing Math and Code Reasoning through SFT and RL Synergy
ICLR 2026Poster
22
Music Flamingo: Scaling Music Understanding in Audio Language Models
ICLR 2026Poster
通讯17
UALM: Unified Audio Language Model for Understanding, Generation and Reasoning
ICLR 2026Oral
31
RLP: Reinforcement as a Pretraining Objective
ICLR 2026Poster
14
Nemotron-Research-Tool-N1: Exploring Tool-Using Language Models with Reinforced Reasoning
ICLR 2026Poster
24
Front-Loading Reasoning: The Synergy between Pretraining and Post-Training Data
ICLR 2026Poster
通讯30
TangoFlux: Super Fast and Faithful Text to Audio Generation with Flow Matching and Clap-Ranked Preference Optimization
ICLR 2026Poster
15
OmniVinci: Enhancing Architecture and Data for Omni-Modal Understanding LLM
ICLR 2026Poster
12
FusionFactory: Fusing LLM Capabilities with Multi-LLM Log Data
ICLR 2026Withdrawn
20
Audio Flamingo 3: Advancing Audio Intelligence with Fully Open Large Audio Language Models
NeurIPS 2025Spotlight
通讯14
Prismatic Synthesis: Gradient-based Data Diversification Boosts Generalization in LLM Reasoning
NeurIPS 2025Spotlight
15
Efficient Hybrid Language Model Compression through Group-Aware SSM Pruning
NeurIPS 2025Poster
9
Audio Flamingo 2: An Audio-Language Model with Long-Audio Understanding and Expert Reasoning Abilities
ICML 2025Poster
通讯14
NV-Embed: Improved Techniques for Training LLMs as Generalist Embedding Models
ICLR 2025Spotlight
22
AceReason-Nemotron: Advancing Math and Code Reasoning through Reinforcement Learning
NeurIPS 2025Poster
33
Eagle: Exploring The Design Space for Multimodal LLMs with Mixture of Encoders
ICLR 2025Spotlight
11
ETTA: Elucidating the Design Space of Text-to-Audio Models
ICML 2025Poster
通讯20
Eagle 2.5: Boosting Long-Context Post-Training for Frontier Vision-Language Models
NeurIPS 2025Poster
32
Synthio: Augmenting Small-Scale Audio Classification Datasets with Synthetic Data
ICLR 2025Poster
21
Fugatto 1: Foundational Generative Audio Transformer Opus 1
ICLR 2025Poster
通讯12
FeatSharp: Your Vision Model Features, Sharper
ICML 2025Poster
22
MM-EMBED: UNIVERSAL MULTIMODAL RETRIEVAL WITH MULTIMODAL LLMS
ICLR 2025Poster
22
Elucidating the Design Space of Text-to-Audio Models
ICLR 2025Rejected
通讯25
OMCAT: Omni Context Aware Transformer
ICLR 2025Rejected
通讯17
UniWav: Towards Unified Pre-training for Speech Representation Learning and Generation
ICLR 2025Poster
通讯6
MIND: Math Informed syNthetic Dialogues for Pretraining LLMs
ICLR 2025Poster
通讯27
ChatQA 2: Bridging the Gap to Proprietary LLMs in Long Context and RAG Capabilities
ICLR 2025Poster
通讯20
A$^2$-Flow: Alignment-Aware Pre-training for Speech Synthesis with Flow Matching
ICLR 2025Rejected
通讯25
PHI-S: Distribution Balancing for Agglomerative Models
ICLR 2025Rejected
11
LLM Pruning and Distillation in Practice
ICLR 2025Rejected
通讯7
Nemotron-CORTEXA: Enhancing LLM Agents for Software Engineering Tasks via Improved Localization and Solution Diversity
ICML 2025Poster
通讯