01 | GPT-3¶ 约 79 个字 预计阅读时间不到 1 分钟 Language Models are Few-Shot Learners — Brown et al., NeurIPS 2020 核心贡献 ¶ 规模扩展:175B 参数,验证了 LM 性能随规模平滑提升的 scaling law In-Context Learning:无需微调,仅通过 few-shot prompt 即可完成多种下游任务 奠定了 GPT 系列及后续大语言模型的基础范式 Was this note helpful? 感谢支持~ 感谢指出,欢迎提 issue 或发邮件反馈~