Yulei Qin
- Incentivizing Reasoning for Advanced Instruction-Following of Large Language Models
- LTD-Bench: Evaluating Large Language Models by Letting Them Draw
- MME: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models
- Optimizing Distributional Geometry Alignment with Optimal Transport for Generative Dataset Distillation