Wengang Zhou
- Enhancing the Outcome Reward-based RL Training of MLLMs with Self-Consistency Sampling
- Image as a World: Generating Interactive World from Single Image via Panoramic Video Generation
- Mitigating Hallucination in VideoLLMs via Temporal-Aware Activation Engineering
- Optimizing Distributional Geometry Alignment with Optimal Transport for Generative Dataset Distillation