跳转至

06 | Gemini

80 个字 预计阅读时间不到 1 分钟

Gemini: A Family of Highly Capable Multimodal Models — Google DeepMind, 2023

核心贡献

  • 原生多模态:从训练开始融合文本、图像、音频、视频
  • 三个规模:Ultra / Pro / Nano,覆盖云端到端侧
  • MMLU 等基准上首次超越人类专家水平
  • 自研 TPU v4/v5 大规模训练基础设施