positional embeddings
- Generalizable Insights for Graph Transformers in Theory and Practice
- KVLink: Accelerating Large Language Models via Efficient KV Cache Reuse
- Point-MaDi: Masked Autoencoding with Diffusion for Point Cloud Pre-training
- VQToken: Neural Discrete Token Representation Learning for Extreme Token Reduction in Video Large Language Models