
Gemini是谷歌DeepMind团队基于2012年启动的人工智能研究计划开发的多模态大模型,为应对ChatGPT挑战,谷歌于2023年1月促使联合创始人回归并加速AI开发,历经PaLM、PaLM 2(2023年5月发布)等迭代阶段,于2023年12月6日正式发布。
该模型基于Transformer架构,采用原生多模态设计,支持文本、图像、音频、视频及代码的联合处理。初代Gemini 1.0包含Ultra(复杂任务)、Pro(通用场景)和Nano(移动端)三个版本,自2023年12月13日起通过Google AI Studio和Vertex AI平台向开发者开放API。
2024年2月,谷歌将旗下聊天机器人Bard更名为Gemini,推出Advanced版本,并发布Gemini 1.5;12月,谷歌发布Gemini 2.0。2025年3月新增MTEB排名第一的Gemini Embedding模型及推理模型Gemini 2.5;11月18日,谷歌正式发布Gemini 3,模型生态整合至谷歌搜索、广告系统、Chrome浏览器、智能家居及Android Auto车载系统,并在图像生成、编程辅助、长文本分析等场景广泛应用。2026年5月,谷歌推出Gemini 3.5 Flash新模型 ;6月,苹果公司正式宣布与谷歌达成合作,将谷歌Gemini大模型引入Apple Intelligence,并推出全新的AI架构 。6月9日,谷歌宣布推出Gemini 3.5实时翻译模型。 2026年6月30日起,所有符合条件的美国用户都可以免费使用。 当地时间7月14日,谷歌表示,将Chrome浏览器中Gemini AI功能扩展至英国桌面端用户,iOS版8月推出。 7月22日消息,本次更新并未包含市场期待已久的旗舰模型 Gemini3.5Pro。该模型自2月更新后,因内部性能达标挑战出现发布延迟,正处于partner阶段测试中,官方表示将争取尽快上线 。当地时间7月22日,谷歌公布,Gemini AI 应用的月活跃用户已经达到 9.5 亿。
想要了解更多“Gemini(2023年12月谷歌推出的人工智能多模态大模型)”的信息,请点击:Gemini(2023年12月谷歌推出的人工智能多模态大模型)百科
