06 | Gemini¶ 约 80 个字 预计阅读时间不到 1 分钟 Gemini: A Family of Highly Capable Multimodal Models — Google DeepMind, 2023 核心贡献 ¶ 原生多模态:从训练开始融合文本、图像、音频、视频 三个规模:Ultra / Pro / Nano,覆盖云端到端侧 在 MMLU 等基准上首次超越人类专家水平 自研 TPU v4/v5 大规模训练基础设施 Was this note helpful? 感谢支持~ 感谢指出,欢迎提 issue 或发邮件反馈~