Ch-1-Transformer-Foundations○Input Representation○Multi Head Attention○Positional Information○Self Attention○Why TransformersCh-2-Transformer-Architectures○Decoder○Encoder Decoder○Encoder○Full TransformerCh-3-Transformer-Models○BERT○GPT○Modern Variants○T5
Ch-1-Transformer-Foundations○Input Representation○Multi Head Attention○Positional Information○Self Attention○Why Transformers