rotary positional encodings
- A Circular Argument: Does RoPE need to be Equivariant for Vision?
- Causality-Induced Positional Encoding for Transformer-Based Representation Learning of Non-Sequential Features
- HELM: Hyperbolic Large Language Models via Mixture-of-Curvature Experts
- VITRIX-CLIPIN: Enhancing Fine-Grained Visual Understanding in CLIP via Instruction-Editing Data and Long Captions