AI 资源中心

Google Gemini

Google Gemini

 

GeminiGoogle 的先进多模态人工智能模型家族与主力 AI 助理平台。它可以原生处理并整合文字、图像、音频、视频和代码等多种数据形态,并深度整合在 Google 搜索、Workspace 及 Android 系统中,协助用户进行日常写作、复杂编程和深度研究。

Gemini是一款由Google DeepMind(谷歌母公司Alphabet下设立的人工智能实验室)于2023年12月6日发布的人工智能模型,可同时识别文本、图像、音频、视频和代码五种类型信息,还可以理解并生成主流编程语言(如Python、Java、C++)的高质量代码,并拥有全面的安全性评估。Google BARD是一个早期的实验性项目,它让你可以和生成式AI 合作。 它是由一个大型语言模型(LLM)驱动的,具体来说是LaMDA 的一个轻量化和优化版本。“Gemini 是 Google 各团队大规模协作的结果,“它是从头开始构建的多模态,这意味着它可以概括和无缝理解、操作和组合不同类型的信息,包括文本、代码、音频、图像和视频。”

Google Gemini 是多模态 AI 助理,能处理文字、图像、音频、视频和代码。它可用于日常文字创作与翻译、分析长篇文件或影片、生成与编辑图像、编写及除错程序码,并能深度整合 Google 搜寻、Gmail 和 Google 云端硬盘等生态系服务。

核心功能与特点

  • 多模态理解:能同时阅读长文件、分析图表、辨识图像与解析影音内容。
  • Google 生态整合:直接连结 Gmail、Google 文档、云端硬盘、YouTube 与 Google 地图等常用服务。

不同算力分工

  • Flash 系列:兼顾速度与推理能力的日常主力模型。
  • Pro 系列:专攻高难度任务、长文本分析与复杂编程的高阶模型。

 谷歌 Gemini 中文官网