Xiao Ma
- BridgeVLA: Input-Output Alignment for Efficient 3D Manipulation Learning with Vision-Language Models
- Chain-of-Action: Trajectory Autoregressive Modeling for Robotic Manipulation
- Flow-Based Policy for Online Reinforcement Learning
- Human-assisted Robotic Policy Refinement via Action Preference Optimization