跳转至

01 | GPT-3

79 个字 预计阅读时间不到 1 分钟

Language Models are Few-Shot Learners — Brown et al., NeurIPS 2020

核心贡献

  • 规模扩展175B 参数,验证了 LM 性能随规模平滑提升的 scaling law
  • In-Context Learning:无需微调,仅通过 few-shot prompt 即可完成多种下游任务
  • 奠定了 GPT 系列及后续大语言模型的基础范式