downstream task performance
- Analyzing Similarity Metrics for Data Selection for Language Model Pretraining
- MLLMs Need 3D-Aware Representation Supervision for Scene Understanding
- Reinforcement Learning Finetunes Small Subnetworks in Large Language Models
- Vision-and-Language Training Helps Deploy Taxonomic Knowledge but Does Not Fundamentally Alter It