Google 的多模态AI模型,原生支持文本、图片、音频、视频理解
Gemini 是 Google 推出的多模态 AI 模型,原生支持文本、图片、音频、视频的理解和生成。Gemini Ultra 是 Google 最强大的 AI 模型,对标 GPT-4。
Gemini 与 Google 生态深度整合,可以直接在 Gmail、Docs、Search 等 Google 服务中使用。其多模态理解能力,尤其是视频理解能力,在同类产品中领先。