efficient inference
- Disentangling Latent Shifts of In-Context Learning with Weak Supervision
- Don't Just Chase “Highlighted Tokens” in MLLMs: Revisiting Visual Holistic Context Retention
- Don’t Trade Off Safety: Diffusion Regularization for Constrained Offline RL
- DynaAct: Large Language Model Reasoning with Dynamic Action Spaces
- The Quotient Bayesian Learning Rule