Jing Wang
- Act to See, See to Act: Diffusion-Driven Perception-Action Interplay for Adaptive Policies
- Enhancing Consistency of Flow-Based Image Editing through Kalman Control
- From Indicators to Insights: Diversity-Optimized for Medical Series-Text Decoding via LLMs
- FuncGenFoil: Airfoil Generation and Editing Model in Function Space
- Generalizable Hand-Object Modeling from Monocular RGB Images via 3D Gaussians
- REFED: A Subject Real-time Dynamic Labeled EEG-fNIRS Synchronized Recorded Emotion Dataset
- StreamForest: Efficient Online Video Understanding with Persistent Event Memory
- Unified 2D-3D Discrete Priors for Noise-Robust and Calibration-Free Multiview 3D Human Pose Estimation
- Vicinity-Guided Discriminative Latent Diffusion for Privacy-Preserving Domain Adaptation
- WISA: World simulator assistant for physics-aware text-to-video generation