llama models
- HALO: Hadamard-Assisted Lower-Precision Optimization for LLMs
- LaX: Boosting Low-Rank Training of Foundation Models via Latent Crossing
- Less is More: Improving LLM Alignment via Preference Data Selection
- Reasoning Models Hallucinate More: Factuality-Aware Reinforcement Learning for Large Reasoning Models