Zheng Zhang
- DAPO: An Open-Source LLM Reinforcement Learning System at Scale
- LaX: Boosting Low-Rank Training of Foundation Models via Latent Crossing
- SharpZO: Hybrid Sharpness-Aware Vision Language Model Prompt Tuning via Forward-Only Passes
- ShortListing Model: A Streamlined Simplex Diffusion for Discrete Variable Generation