Yang Yu
- Adaptable Safe Policy Learning from Multi-task Data with Constraint Prioritized Decision Transformer
- Focus-Then-Reuse: Fast Adaptation in Visual Perturbation Environments
- Multi-Agent Imitation by Learning and Sampling from Factorized Soft Q-Function
- TCM-Ladder: A Benchmark for Multimodal Question Answering on Traditional Chinese Medicine
- Uncertainty-Sensitive Privileged Learning