TECHNOLOGY BRIEF / 人工智能

Gemini 1.0 发布,以多模态模型覆盖云端与端侧场景

Google 推出 Gemini 1.0,包含 Ultra、Pro 和 Nano 三种规格,分别面向复杂任务、广泛应用与端侧计算。官方介绍其从训练阶段结合文本、代码、音频、图像与视频信息,并公布多模态理解和代码任务的评测。

原文发布 本次整理 历史回顾来源:Google 官方博客
黑色背景上的 Gemini 标志与在中央交织的多彩线条
图源 · Google查看原文配图 ↗

发生了什么

  • 三种模型规格对应不同计算资源和应用需求。
  • 模型设计强调对多种信息形式进行联合理解与推理。

Google 官方博客 · 查看原文

ENGINEERING PERSPECTIVE

对工程应用的启发

工程观察:处理图文混合资料时,可按任务与设备条件选择模型规格,并通过自己的数据集验证跨模态理解能力。

以上为基于公开资料的应用思考,具体能力与适用范围需结合原文和实际测试判断。

← 返回科技情报