Transformer Explainer: LLM Transformer Model Visually Explained

transformersgpt-2self-attentionneural-networksvisualizationeducation

Abstraction: Interactive visual walkthrough of Transformer/GPT-2 architecture

Key points:

Connections: GPT-2 · Andrej Karpathy · Georgia Tech · Transformers · Self Attention · Large Language Models · Tokenization

Source: https://poloclub.github.io/transformer-explainer/?ref=sentiers.media