专栏 AI 管理编年史 第 148/217 讲 查看课程目录

Google DeepMind发布新版Gemini Deep Research智能体,通过Interactions API开放企业接入

11/12/2025 180
3:59
Google DeepMind发布新版Gemini Deep Research智能体,通过Interactions API开放企业接入

Google于2025年12月11日通过Interactions API发布新版Gemini Deep Research智能体,同步推出DeepSearchQA基准测试,首次让开发者能将自主研究能力直接嵌入自己的应用程序。

2025年12月11日,Google通过Interactions API发布全新版本的Gemini Deep Research智能体,并同步推出DeepSearchQA——一套专门用来评测复杂网页搜索任务的基准测试。这是Google首次让外部开发者能直接把自家最先进的自主研究能力,嵌入到自己的应用程序当中,而不仅限于在Gemini App或Search内部使用。

此次发布的Deep Research智能体,推理核心采用Gemini 3 Pro。Google官方表示,这是目前旗下最重视事实准确度的模型,经过特别训练以降低幻觉,并在处理需要多步骤推理的复杂任务时提升最终报告的质量。同步推出的DeepSearchQA基准,则用来检验智能体在真实网页搜索场景下,能否正确收集、比对、汇总多方信息来源并产出可信结论,也让外界有一套公开标准来衡量「研究智能体」的实际能力,而不只是听厂商自说自话。

技术意义:从「应用内功能」变成「可嵌入的API能力」

过去Deep Research多是绑定在Gemini App或Google Search内的封装功能,用户只能在既定界面上提问、等待整份报告产出。这次通过Interactions API开放,意味着开发者可以把「自主研究」这项能力抽离出来,直接组装进自己的产品里——例如企业内部知识库、客服系统、市场情报工具,都能调用同一套智能体逻辑完成收集、比对、汇总、产出报告的整套流程,无需重新造轮子。这也是Google在智能体型AI竞赛中,把「工具」变成「基础设施」的一步。

与前代及同业的比较

相较于11月发布的GPT-5.1、Grok 4.1等竞品模型主打通用推理与代码能力,Google这次选择聚焦在「研究型智能体」这一更垂直的场景,并用DeepSearchQA这个自建基准来定义「好的研究智能体」应有的标准,而不只是比拼通用测试分数。这种「先立基准、再开放API」的做法,某种程度也是在向企业客户证明,其智能体输出的报告质量是可被量化检验的,不是一个黑箱。

业界反应

开发者社区普遍关注的重点,在于Interactions API能否稳定支撑长时间、多步骤的研究任务(这类任务往往需要数分钟到数十分钟才能完成),以及计费模式是否对高频使用的企业友好。多数评论认为,若Gemini 3 Pro确实在事实准确度上有实质提升,将是B2B市场情报、产业研究类应用的重要转折点,也可能促使更多企业把「查资料、写报告」这类工作交给智能体先出初稿。

对管理者而言,这则新闻的意义在于:市场研究、竞品分析、法规梳理这类过去依赖顾问或分析师人力的工作,正快速变成「一次API调用就能拿到初稿」的能力。管理者不必自己写代码,但值得留意公司内部是否已有部门在评估引入这类研究智能体,并提前思考如何验证AI产出报告的准确度与可信度,避免把「初稿」误当成「定稿」。

测验检核:验证你的理解
5 篇 · 答对 80% 通过,通过后计入学习履历 登录后即可测验
问 AI:这篇文章怎么用在我的管理上?
内容由 AI 根据本文辅助生成,仅供参考,请自行判断准确性。
下一讲・AI 管理编年史 NVIDIA发布Nemotron 3开放模型家族,主打多智能体系统低成本部署

相关文章

我们使用必要 Cookie 维持登录与语言设置,并记录使用行为以改善服务。你可以只保留必要项目。 隐私权政策