lucidrains/x-transformers
A concise but complete full-attention transformer with a set of promising experimental features from various papers
Lineage graph
Paper → model → repo connections mined from source citations (Tier-1 exact match).
Why these links exist
Every edge carries a method, confidence, and the source snippet that justified it — so bad links are debuggable.
- PossiblePossibly related (embedding) · 58%Build your first transformer from scratch →
- PossiblePossibly related (embedding) · 48%Generalization Analysis of Transformers in Distribution Regression →
- PossiblePossibly related (embedding) · 47%Morphing into Hybrid Attention Models →
- FuzzySimilar title/name (fuzzy) · 87%Grokking in small transformers →
“Fuzzy title match (0.94): “Grokking in small transformers” ≈ “lucidrains/x-transformers””
- FuzzySimilar title/name (fuzzy) · 87%Kaleido: Algorithm-Hardware Co-Design for Video Diffusion Transformers by Exploiting Latent Space Correlations →
“Fuzzy title match (0.94): “Kaleido: Algorithm-Hardware Co-Design for Video Diffusion Tr” ≈ “lucidrains/x-transformers””
- FuzzySimilar title/name (fuzzy) · 87%MxGPS: Multiplex Graph Transformers for a Power Grid Foundation Model →
“Fuzzy title match (0.94): “MxGPS: Multiplex Graph Transformers for a Power Grid Foundat” ≈ “lucidrains/x-transformers””
- FuzzySimilar title/name (fuzzy) · 87%FlexViT: A Flexible FPGA-based Accelerator for Edge Vision Transformers →
“Fuzzy title match (0.94): “FlexViT: A Flexible FPGA-based Accelerator for Edge Vision T” ≈ “lucidrains/x-transformers””
- FuzzySimilar title/name (fuzzy) · 87%Inhibited Self-Attention: Sharpening Focus in Vision Transformers →
“Fuzzy title match (0.94): “Inhibited Self-Attention: Sharpening Focus in Vision Transfo” ≈ “lucidrains/x-transformers””
