Gemini 3.8 Live 上線:語音模型分低延遲與高推理兩款
Google 在 9 月 15 日推出兩款語音模型 Gemini 3.8 Live 與 Gemini 3.8 Live Extended Thinking。依 Gemini API 官方更新日誌,兩款同日正式上線(GA),定位是走 Live API 的 audio-to-audio 模型,也就是輸入與輸出都直接是語音,用於即時語音應用。
兩款的分工:一款搶低延遲,一款換取推理深度
官方日誌把兩者的取捨寫得很直接。Gemini 3.8 Live(型號 gemini-3.8-live)是多數低延遲語音代理與即時對話的預設選項,強調不因推理而產生延遲,特性包括交錯式推理、預設非同步函式呼叫,以及完整的工作階段用戶端內容更新。
Gemini 3.8 Live Extended Thinking(型號 gemini-3.8-live-extended-thinking)則是高推理版本,支援在即時語音互動進行的同時於背景推理,官方建議在需要較高背景推理能力時使用。換句話說,前者把延遲壓到最低,後者容許模型一邊對話一邊想得更久。
官方列出的四項共同能力
Google DeepMind 在官方帳號的貼文中列出兩款模型的共同特性:升級的推理能力、接近即時的視覺理解、97 種語言的自動偵測,以及背景工具呼叫且不中斷對話。針對 Extended Thinking 版本,貼文另外說明它在最困難的任務上提供更高的效能與精確度,並會在執行過程中描述任務進度,讓對話不致中斷。
貼文示範的情境是把 3.8 Live Extended Thinking 當成程式設計家教。使用管道方面,一般使用者可在 Gemini App 的 Gemini Live 中使用,開發者則透過 Gemini API 與 Google AI Studio 接入。
兩週內第二款 3.8 系列模型
這是 Gemini 3.8 系列在兩週內的第二次動作。依同一份更新日誌,Gemini 3.8 Flash 於 9 月 2 日正式上線,主打長週期軟體工程、自主代理與複雜企業工作流程,鏈新聞當時報導過該款與其 Cyber 版本。9 月 3 日則是音樂生成模型 Lyria 3.5 上線。
Gemini 各代模型的定位與差異,可參考Google Gemini 完整指南;與其他主流模型的比較另見ChatGPT、Claude 與 Gemini 比較。
風險提示
加密貨幣投資具有高度風險,其價格可能波動劇烈,您可能損失全部本金。請謹慎評估風險。




