03 | PostTrain¶ 约 54 个字 预计阅读时间不到 1 分钟 为什么需要 Post-Train ¶ 预训练模型“会续写”,但不一定“会按人类偏好回答” 目标是提升可用性、真实性和安全性 全量微调 ¶ PEFT¶ LoRA¶ Prompt Tuning¶ Domain Adaptive Fine-Tuning¶ Was this note helpful? 感谢支持~ 感谢指出,欢迎提 issue 或发邮件反馈~