Yike Guo
- Foundation Cures Personalization: Improving Personalized Models’ Prompt Consistency via Hidden Foundation Knowledge
- Generative RLHF-V: Learning Principles from Multi-modal Human Preference
- InterMT: Multi-Turn Interleaved Preference Alignment with Human Feedback
- Safe RLHF-V: Safe Reinforcement Learning from Multi-modal Human Feedback