LLMs and Transformers from First Principles — Tokenization, Attention, Embeddings, Pretraining, and Fine-tuning (with PyTorch and Hugging Face Code)
LLMs from first principles: tokenization, embeddings, RoPE, self-attention, multi-head, nanoGPT, pretraining, SFT, LoRA, QLoRA, DPO, vLLM serving.