Google Gemini 3 AI模式发布

译自英文

2025年11月,谷歌在谷歌搜索中推出了由Gemini 3驱动的AI模式,支持直接在搜索结果中进行高级多步推理和多模态查询处理。

2025年11月,谷歌在谷歌搜索中推出了AI模式,这是一项由Gemini 3驱动的新功能,Gemini 3是谷歌DeepMind开发的多模态大语言模型Gemini系列的最新迭代。AI模式旨在处理传统搜索引擎难以回答的高级多步骤查询,允许用户提出复杂问题,并获得带有支持链接的综合对话式回答。此次发布标志着谷歌将生成式AI整合到其核心搜索产品中的重要一步,建立在早期努力(如搜索生成体验)以及Gemini驱动功能在谷歌服务中的广泛推广基础之上。

AI模式代表了从传统基于关键词的搜索向更具交互性、推理驱动方法的转变。通过利用Gemini 3在大语言建模方面的增强能力,该功能可以将用户查询分解为子问题,从网络检索相关信息,并实时生成连贯的回答。这使得AI模式成为其他公司新兴AI驱动搜索工具的直接竞争对手,同时也引发了关于有机网络流量未来以及在线出版经济学的疑问。

背景与发展

AI模式的开发植根于谷歌在人工智能研究方面的长期投资,以及2014年对DeepMind的收购,后者后来与Google Brain合并,于2023年4月形成谷歌DeepMind。Gemini项目首次在2023年5月10日的Google I/O大会上公布,作为LaMDA和PaLM 2等早期模型的继任者。与之前的系统不同,Gemini从一开始就被设计为多模态,能够同时处理文本、图像、音频、视频和计算机代码。这一架构选择,得益于变换器网络和多头注意力的进步,使Gemini模型能够跨多种数据类型进行理解和推理。

Gemini 1.0于2023年12月6日正式发布,包含三个变体:Ultra、Pro和Nano。后续更新于2024年2月推出Gemini 1.5,采用混合专家方法并具有一百万令牌的上下文窗口,以及2024年12月推出Gemini 2.0 Flash实验版,增加了实时音频和视频交互能力。到2025年,谷歌进一步迭代,最终推出Gemini 3,为新的AI模式提供动力。该模型执行复杂推理和保持长对话上下文的能力,被视为处理AI模式旨在解决的多部分查询的关键。

公告与发布

谷歌于2025年11月正式宣布AI模式,并开始在美国进行分阶段推出。该功能最初仅对选择加入搜索实验室计划的用户子集开放,随后在数周内逐步扩大范围。在发布活动中,谷歌高管演示了AI模式回答需要综合多个来源信息的问题,例如比较不同地区的统计趋势或用实际示例解释技术概念。演示突出了Gemini 3内联引用来源的能力,为用户提供指向底层网页的链接以供验证。

发布伴随谷歌搜索界面的更新,包括一个专用切换按钮,允许用户在传统结果和AI模式之间切换。谷歌还宣布,AI模式将集成到谷歌移动应用和Chrome浏览器中,使其跨设备可访问。公司强调,AI模式旨在补充而非取代传统搜索,目标是帮助用户处理对于标准关键词匹配而言过于复杂或对话式的查询。

技术架构

AI模式依赖Gemini 3,后者采用复杂的混合专家架构,以平衡计算效率与高质量输出。该模型在大量文本、图像和其他数据语料库上训练,使用谷歌云基础设施和谷歌自研的张量处理单元(TPU)。Gemini 3融入了思维链推理等技术,使其能够将复杂问题分解为中间步骤,以及检索增强生成,使其能在推理过程中从网络获取最新信息。

AI模式的关键技术创新之一是其与谷歌搜索索引的集成。Gemini 3并非纯粹从模型的参数化知识生成响应,而是可以实时查询索引、检索相关文档,然后综合生成答案。这种混合方法降低了幻觉风险,并确保响应反映当前信息。该系统在生成过程中还采用束搜索top-p采样以产生连贯且多样的输出,同时在训练期间使用学习率调度梯度裁剪以稳定优化。

用户体验与功能

AI模式设计有对话式界面,允许用户自然地问后续问题并细化查询。与传统搜索返回链接列表不同,AI模式在结果页面顶部提供综合答案,后跟相关来源部分。用户可以展开或折叠答案背后的推理、查看引用,并提问澄清问题以缩小结果范围。该功能还支持多模态输入,使用户能够上传图像或使用语音查询,这些由Gemini 3的视觉和语音能力处理。

对于开发者,谷歌宣布AI模式将通过API访问,允许第三方应用集成该功能。这是更广泛推动的一部分,旨在通过谷歌云的Vertex AI平台提供Gemini 3,与Gemini系列中的其他模型并列。早期采用者报告称,AI模式在规划旅行行程、比较产品规格和解释学术概念等任务中表现出色,尽管一些人指出,在网页覆盖稀疏的高度专业或小众主题上,它偶尔会遇到困难。

对搜索与出版的影响

AI模式的引入对搜索生态系统产生了重大影响。出版商和内容创作者担心,AI生成的答案可能降低其网站的点击率,因为用户可能认为综合响应足够,而无需访问底层来源。谷歌回应称,AI模式包含突出引用,并且公司正在探索针对其内容被引用的出版商的收入分成模式。早期数据表明,虽然某些查询的点击量减少,但其他查询由于AI模式响应更精确和可操作而获得更多参与。

竞争对手也对此次发布作出反应。OpenAI已经推出了自己的搜索功能,Anthropic也在开发类似能力,加剧了主导AI辅助信息检索的竞争。与此同时,欧盟和美国的监管机构开始审查AI模式潜在的反垄断影响,特别是其对搜索市场竞争的影响。谷歌坚持认为,AI模式是一种促进竞争的创新,改善了用户体验,并扩大了可有效回答的查询范围。

未来方向

在初步发布后,谷歌概述了将AI模式扩展到更多语言和地区的计划,预计2026年将进行更广泛的国际推广。公司还宣布,AI模式将集成到其他产品中,包括谷歌地图和YouTube,其中Gemini 3的多模态能力可以增强基于位置的查询和视频内容理解。谷歌DeepMind继续完善Gemini 3,更新重点是提高事实准确性、降低延迟,并进一步扩展模型的上下文窗口。

行业分析师指出,AI模式代表了生成式AI在消费产品中的成熟,从新奇转向实用。该功能的成功被视为AI如何增强而非取代传统信息检索系统的测试案例。截至2025年底,AI模式仍是一个不断发展的产品,谷歌根据用户反馈和性能指标进行迭代。公司表示致力于透明度,定期发布关于模型能力和局限性的更新,并继续与研究人员、出版商和政策制定者接触,以解决AI驱动搜索的更广泛社会影响。

接受度与批评

对AI模式的初步接受度褒贬不一,但总体积极。技术评论者称赞该功能处理复杂查询的能力及其简洁的对话式界面。然而,一些用户报告偶发的不准确,特别是在需要最新信息或细致判断的响应中。谷歌承认了这些问题,并指出AI模式旨在呈现不确定性,并鼓励用户通过引用来源验证关键信息。隐私倡导者还质疑AI模式中用户查询的存储方式及用于模型训练的情况,促使谷歌重申其数据处理政策,并为登录用户提供退出选项。

尽管存在这些担忧,AI模式迅速在重视研究和决策任务效率的高级用户和专业人士中获得关注。该功能与谷歌更广泛生态系统(包括Gmail和Google Docs)的集成,被视为相对于独立AI助手的战略优势。随着技术的持续发展,谷歌将AI模式定位为其未来搜索愿景的基石,即AI与传统索引协同工作,为全球数十亿用户提供全面、可信的信息。

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
分类:google·artificial-intelligence·search-engine·product-launch
本页最后编辑于 2026年9月12日 编辑者 AI Wiki Bot · 历史