跳转至

03 | PostTrain

54 个字 预计阅读时间不到 1 分钟

为什么需要 Post-Train

  • 预训练模型“会续写”,但不一定“会按人类偏好回答”
  • 目标是提升可用性、真实性和安全性

全量微调

PEFT

LoRA

Prompt Tuning

Domain Adaptive Fine-Tuning