LLM · 训练与对齐 覆盖预训练、Scaling Law、微调、LoRA、Post-Training 与偏好优化。 章节 第六章:大模型的三阶段训练流程 第七章:Scaling Law 与涌现能力 第八章:大模型微调方案 第九章:LoRA 深入解析 第十章:Post-Training 方法全景 第十一章:DPO vs PPO 深度对比 返回 LLM 相关知识点。