產品發佈
Google DeepMind 推出 Gemini 3.8 Live 與 3.8 Live Extended Thinking
Introducing Gemini 3.8 Live and 3.8 Live Extended Thinking

deepmind.google · 2026-09-15
摘要
Google DeepMind 正式發布 Gemini 3.8 Live 版本,並同步推出支援 Extended Thinking(延伸思考)能力的更新。此更新強化了模型在處理複雜任務時的推理深度與即時互動體驗,為開發者與使用者提供更強大的 AI 輔助能力。
宣布推出 Gemini 3.8 Live 系列模型
Google 宣布推出 Gemini 3.8 Live 與 Gemini 3.8 Live Extended Thinking 兩款新模型,號稱是目前最先進的即時對話模型。這次更新的重點是提升智慧程度與平行推理能力,讓使用者處理複雜任務時可以用語音進行更直覺、流暢的協作。兩款模型都支援即時視覺情境處理、背景任務執行,以及在不打斷對話的情況下完成多步驟推理,目前已可透過 Gemini API、Google Workspace 與 Gemini 應用程式使用。
性能指標與基準測試表現
技術表現上,Gemini 3.8 Live Extended Thinking 主打處理高複雜度任務,強化了智慧與多步驟推理能力。根據 Artificial Analysis 的 Speech to Speech Quality Index,該模型以 82.6 分拿下整體第一。在 τ-Voice 基準測試中,代理任務完成率達 68.6%;在 Sierra 的 τ-Voice-banking 基準測試中則是 35.1%。另外在 Big Bench Audio 測試拿到 97.7%,推理能力強,價格也有競爭力。
Gemini 3.8 Live 則在 Speech Agent Arena 拿下第二名,顯示使用者偏好度高。該模型在 ServiceNow 的 EVA-Bench 基準測試中,在複雜工作流的準確率與對話品質之間找到平衡點,推動了帕累托前沿(Pareto Frontier)往前推進。對開發者與企業來說,這兩款模型提供了可靠、能直接投入生產環境的語音代理基礎元件,在規模化與成本效益上表現不錯。
核心功能:即時視覺、多語言與背景執行
Gemini 3.8 Live 能近乎即時處理視覺輸入,為對話補充上下文資訊,讓回應更有幫助。模型支援對話中自動偵測並切換 97 種語言,跨語言溝通不會卡關。另一個關鍵功能是背景工具執行:模型需要呼叫 API 或執行工具時,可以在後台處理,同時繼續跟使用者對話,不會因為等結果而讓對話中斷。
針對需要深層推理的場景,Gemini 3.8 Live Extended Thinking 可以邊推理邊說話。它會用「讓我查一下…」這類早期語音提示自然回應使用者,並透過即時進度敘述,讓使用者知道多步驟背景任務進行到哪。這樣的設計讓模型處理複雜工作流時,既能維持高智慧水準,對話也不會卡頓。
應用場景與生態系整合
實際應用上,Google 展示了幾個案例。Gemini 3.8 Live 可用於即時員工入職引導,透過視覺上下文回答現場問題,也能近乎即時地透過視覺上下文下棋。Gemini 3.8 Live Extended Thinking 則能把手繪草圖搭配近乎即時的語音反饋,轉換成可運作的 React 元件,或是協調多步驟的預訂與非同步函數呼叫,過程不會打斷自然對話。此外,Gemini 3.8 Live 還能透過自然語音即時做出完整商業計畫與客製化行銷工具包。
在 Google 產品生態系中,使用者可在 Google Workspace 的 Docs Live、Gmail Live 與 Keep Live 體驗 Extended Thinking,做每日摘要、收件匣管理或待辦事項交接。在 Search Live 中,使用者可獲得 Gemini 3.8 Live 驅動的即時除錯協助。開發者方面,Agora、Fishjam、LangChain、LiveKit、Pipecat、Vercel 與 Vision Agents 等平台已整合 Gemini Live API,協助開發者建構高性能的語音介面——這些平台負責處理複雜的即時媒體串流基礎設施,開發者可以專心打造使用者體驗。
安全標記與發布時程
為了透明度,所有 Google AI 產品生成的語音都內建 SynthID 不可見水印,直接編織於語音輸出中,可偵測 AI 生成內容,有助於防止誤導性資訊。詳細的安全與責任資訊可參考模型說明文件。
發布時程上,Gemini 3.8 Live 即日起開放使用:開發者可透過 Gemini API 與 Google AI Studio 存取;企業客戶可在 Gemini Enterprise 私人預覽中體驗,並即將推出至 Gemini Enterprise for Customer Experience;一般使用者可在 Search Live 試用。Gemini 3.8 Live Extended Thinking 同樣即日起開放,開發者與企業客戶的存取管道相同,企業客戶另可獲得 Google Workspace 商業客戶的支援。一般使用者可在 Gemini Live 體驗;Google AI Pro 與 Ultra 訂閱用戶可在 Workspace 的 Docs 使用;所有 Google AI 訂閱用戶則可在 Gmail 與 Keep 使用此功能。
●開發者:可關注 Gemini 3.8 Live 的 API 整合與 Extended Thinking 應用場景
●投資人:Google 在生成式 AI 模型迭代上持續領先,關注其商業化進展
●一般用戶:將能體驗更深度思考與即時互動的 AI 服務
重要性評分
🟠 值得關注
喜歡這篇?每天早晨還有更多。
訂閱 5min AI,讓 AI 替你追蹤整個 AI 世界。
相關指南

Gemini 教學:4 步生成 AI 手繪旅遊地圖與實戰應用
透過 Gemini 教學 4 步生成 AI 手繪旅遊地圖,掌握從概念到實作的完整流程。本文涵蓋 Gemini Developer API 定價分析、Google AI Studio 與 Gemini Canvas 對比,以及生成式 AI 在旅遊規劃中的實戰應用技巧。
閱讀指南 →
Gemini Spark 教學:繁中完整上手指南(功能、定價、實測)
Gemini Spark 教學完整指南,深入解析 Gemini Spark 是什麼、怎麼用,並提供繁中介面設定、免費方案詳解與實測效能分析,助您快速上手。
閱讀指南 →
Gemini 2.5 Pro 怎麼免費使用?功能介紹與 ChatGPT 比較
Gemini 2.5 Pro 怎麼免費用?本文說明 Google Gemini 的開啟步驟、免費版和 Advanced 付費版的功能差異,以及 Gemini 2.5 Pro 和 ChatGPT 在哪些場景各有優勢。
閱讀指南 →🤖 本文摘要由 AI 自動生成,內容源自原始報導。如有疑慮,請參閱關於我們。
喜歡這篇?每天早晨還有更多。
訂閱 5min AI,讓 AI 替你追蹤整個 AI 世界。