Google 正式為 Gemini Live 推出一項重要更新,將備受好評的「深度研究(Deep Research)」功能整合至語音體驗中。即日起,所有 Gemini 應用程式用戶都能透過語音指令啟動完整的研究任務,並在稍後查看系統生成的研究報告。
Gemini Live 迎來重大升級,將深度研究功能擴展至語音互動
深度研究功能早已成為 Gemini 的核心能力之一。不同於一般聊天機器人即時提供簡短答案的模式,Gemini 會主動搜尋並分析多個資訊來源,追蹤相關線索,最後整理成一份附有引用來源的完整報告。雖然整個過程可能需要幾分鐘時間,但使用者無須持續停留在應用程式中等待,當研究完成後,系統便會主動發出通知。
不只是問答,而是真正的研究助手
近年來,各大 AI 平台紛紛推出深度研究工具,包括 ChatGPT、Claude 以及 Gemini。這類工具的共同特點在於,它們不再滿足於提供單一答案,而是透過跨來源資訊整合與分析,協助使用者完成更深入的探索與研究。Gemini 的優勢在於能夠結合上傳文件,以及 Gmail、Google 雲端硬碟等已連結服務中的資訊,進一步提升研究內容的完整性與實用性。
由於深度研究需要進行較大量的資料蒐集與分析,因此特別適合市場研究、學習專題、產品比較或資料查證等情境,而非需要立即回覆的簡單問題。
語音與文字無縫切換 保留完整對話脈絡
此次整合至 Gemini Live 後,使用者可在語音和文字兩種互動模式之間自由切換,而不會遺失對話上下文。例如,使用者可以透過 Gemini Live 以語音方式提出研究需求,接著離開應用程式或鎖定手機。當研究完成後,再透過語音詢問研究結果;若需要進一步補充內容,也能切換到文字輸入模式進行追問或修改報告內容,全程無須重新開啟新的對話。
這種跨模式且持續保留上下文的體驗,讓 Gemini 更接近真正具備長期協作能力的 AI 助理。
納入返校季更新向所有用戶開放
Google 表示,這項新功能是 Gemini 返校季更新的一部分。除了深度研究整合至 Gemini Live 之外,更新內容還包括學生中心、學習筆記本以及互動式視覺化工具等新功能。不過,Google 強調,Gemini Live 的深度研究能力並非僅針對學生族群,而是面向所有 Gemini 應用程式用戶開放,讓更多人能透過語音互動方式完成複雜的研究與資訊探索工作。




