Pavlo Molchanov
- Efficient Hybrid Language Model Compression through Group-Aware SSM Pruning
- GSPN-2: Efficient Parallel Sequence Modeling
- Nemotron-CLIMB: Clustering-based Iterative Data Mixture Bootstrapping for Language Model Pre-training
- Nemotron-Flash: Towards Latency-Optimal Hybrid Small Language Models
- Scaling RL to Long Videos