專欄 AI 管理編年史 第 148/217 講 查看課程目錄

Google DeepMind推出新版Gemini Deep Research代理,透過Interactions API開放企業串接

11/12/2025 178
3:59
Google DeepMind推出新版Gemini Deep Research代理,透過Interactions API開放企業串接

Google於2025年12月11日透過Interactions API發表新版Gemini Deep Research代理,同步推出DeepSearchQA基準測試,首度讓開發者能將自主研究能力直接嵌入自己的應用程式。

2025年12月11日,Google透過Interactions API發表全新版本的Gemini Deep Research代理,並同步推出DeepSearchQA——一套專門用來評測複雜網頁搜尋任務的基準測試。這是Google首次讓外部開發者能直接把自家最先進的自主研究能力,嵌入到自己的應用程式當中,而不僅止於在Gemini App或Search內部使用。

此次發表的Deep Research代理,推理核心採用Gemini 3 Pro。Google官方表示,這是目前旗下最重視事實準確度的模型,經過特別訓練以降低幻覺、並在處理需要多步驟推理的複雜任務時提升最終報告的品質。同步推出的DeepSearchQA基準,則是用來檢驗代理在真實網頁搜尋情境下,能否正確蒐集、比對、彙整多方資訊來源並產出可信結論,也讓外界有一套公開標準可以衡量「研究代理」的實際能力,而不只是聽廠商自己說。

技術意義:從「應用內功能」變成「可嵌入的API能力」

過去Deep Research多半是綁定在Gemini App或Google Search內的封裝功能,使用者只能在既定介面上發問、等待整份報告產出。這次透過Interactions API開放,代表開發者可以把「自主研究」這個能力抽出來,直接組裝進自己的產品裡——例如企業內部知識庫、客服系統、市場情報工具,都能呼叫同一套代理邏輯完成蒐集、比對、彙整、產出報告的整套流程,不必自己重新打造一遍。這也是Google在代理型AI競賽中,把「工具」變成「基礎設施」的一步。

與前代及同業的比較

相較於11月發布的GPT-5.1、Grok 4.1等競品模型主打通用推理與程式能力,Google這次選擇聚焦在「研究型代理」這個更垂直的場景,並用DeepSearchQA這個自建基準來定義「好的研究代理」應有的標準,而不只是比拚泛用測試分數。這種「先立基準、再開放API」的做法,某種程度也是在向企業客戶證明,其代理輸出的報告品質是可被量化檢驗的,不是一個黑盒子。

業界反應

開發者社群普遍關注的重點,在於Interactions API是否能穩定支援長時間、多步驟的研究任務(這類任務常需要數分鐘到數十分鐘才能完成),以及計費模式是否對高頻使用的企業友善。多數評論認為,若Gemini 3 Pro確實在事實準確度上有實質提升,將是B2B市場情報、產業研究類應用的重要轉折點,也可能促使更多企業把「找資料、寫報告」這類工作交給代理先做初稿。

對管理者而言,這則新聞的意義在於:市場研究、競品分析、法規盤點這類過去仰賴顧問或分析師人力的工作,正快速變成「一支API呼叫就能取得初稿」的能力。管理者不必自己寫程式,但值得留意公司內部是否已有部門在評估導入這類研究代理,並提早思考如何驗證AI產出報告的準確度與可信度,避免把「初稿」誤當成「定案」。

測驗檢核:驗證你的理解
5 篇 · 答對 80% 通過,通過後計入學習履歷 登入後即可測驗
問 AI:這篇文章怎麼用在我的管理上?
內容由 AI 根據本文輔助生成,僅供參考,請自行判斷準確性。
下一講・AI 管理編年史 NVIDIA發表Nemotron 3開放模型家族,主打多代理系統低成本部署

相關文章

我們使用必要 Cookie 維持登入與語言設定,並記錄使用行為以改善服務。你可以只保留必要項目。 隱私權政策