Part 5: LLM Fundamentals: Using GPT-2 as an Example
No matching items
jshn9515
2026-05-05
2026-10-03
| Title | Author | Date |
|---|---|---|
| 11.1 What Language Models Predict: Next-Token Prediction | jshn9515 | 2026-06-18 |
| 11.2 MiniGPT: From a Causal GPT Block to a Decoder-only Language Model | jshn9515 | 2026-06-20 |
| 11.3 Tokenizer: Characters, BPE, and Vocabulary | jshn9515 | 2026-06-18 |
| 11.4 Embedding, LM Head, and Weight Tying | jshn9515 | 2026-06-18 |
| 11.5 Training MiniGPT on TinyStories | jshn9515 | 2026-06-22 |
| 11.6 From Training to Generation: Temperature, Top-k, and Top-p | jshn9515 | 2026-06-18 |
| 11.7 GPT-2: From MiniGPT to a Pretrained Language Model | jshn9515 | 2026-06-23 |