zero-shot accuracy
- DenoiseRotator: Enhance Pruning Robustness for LLMs via Importance Concentration
- Discovering Important Experts for Mixture-of-Experts Models Pruning Through a Theoretical Perspective
- Do different prompting methods yield a common task representation in language models?
- RSAVQ: Riemannian Sensitivity-Aware Vector Quantization for Large Language Models