Part 8:LLM 基础:以 GPT-2 为例
| Title | Author | Date |
|---|---|---|
| 18.1 语言模型在预测什么:Next-Token Prediction | 2026-06-18 | |
| 18.2 MiniGPT:从 Causal GPT Block 到语言模型 | 2026-06-20 | |
| 18.3 Tokenizer:字符、BPE 与词表 | 2026-06-18 | |
| 18.4 Embedding、LM Head 与 Weight Tying | 2026-06-18 | |
| 18.5 在 TinyStories 上训练 MiniGPT | 2026-06-22 | |
| 18.6 从训练到生成:Temperature、Top-k、Top-p | 2026-06-18 | |
| 18.7 GPT-2:从 MiniGPT 到预训练语言模型 | 2026-06-23 | |
| 19.1 训练一个 LLM 到底花在哪里:模型状态、激活与运行时开销 | 2026-08-15 | |
| 19.8 现代 Attention API 与 Hugging Face Kernels | 2026-06-19 |
No matching items