Google最新人工智慧模型家族今天現身,並用旗艦Gemini 3 Pro預覽版開啟Gemini 3時代。
Google破天荒在發布首日就讓所有用戶在Gemini 應用程式或網頁版介面,體驗旗艦模型Gemini 3 Pro。
要在Google 搜尋中體驗旗艦Gemini 3 Pro,則需訂閱。
問題太難?Gemini 3 Pro畫給你看
Gemini 3 Pro為「原生多模態」模型,意即它能同時處理文字、圖像與音訊,而非分開處理。Google舉例說明,Gemini 3 Pro可以將食譜照片翻譯後整理成一本食譜。它也能根據一連串的教學影片內容,自動製作出互動式的學習記憶卡。
體現在搜尋結果上,過去的搜尋結果是文字,但有了Gemini 3,當你搜尋的主題比較難理解,Gemini 3會自動生成一個客製化、可以互動的圖表或視覺化工具,幫助你直接用看的來理解這個複雜的知識。
Google DeepMind 產品負責人暨資深總監多希(Tulsee Doshi) 表示,Gemini 3 Pro「跳脫僅提供文字回應的框架,轉而呈現更豐富、完整的視覺化內容,讓使用者真正『看得見』資訊的全貌。」
Google 表示,由 Gemini 3 Pro驅動的搜尋,學會了「分散查詢技術」(query fan-out technique),不僅能將問題拆解成多個子題以進行搜尋,還能更準確理解使用者意圖,進而「找出過去可能錯過的全新內容」。
Google 搜尋產品副總裁史坦(Robby Stein)示範可以搜尋多複雜的問題。他向現場記者展示在AI模式下的一個查詢,內容是要求比較具有不同利率和首付款的房屋貸款成本。作為回應,Gemini 3 生成了一個互動式比較工具,以及有關每種選擇的優缺點資訊。
史坦說,「Gemini 3 真正厲害的地方在於,它可以在底層提出更廣泛、更細微的提問。在搜尋中直接回答使用者的一些最難的問題。」
除了以上的升級外,Gemini 3 Pro還具備更強的推理能力與自主行動能力,像是實驗性功能「Gemini Agent」,可以執行更長時間、更複雜的AI代理規劃,像是行程規劃等。
隨著外界關於 AI 泡沫化的討論愈演愈烈,Google積極強調Gemini 3不只是聰明的模型或聊天機器人,更能從發布的這一刻開始,全面改善Google現有產品,包含為搜尋業務提升利潤。
Google DeepMind 執行長哈薩比斯(Demis Hassabis)在發表會前接受WIRED採訪表示, AI市場看起來似乎有泡沫化的現象,許多還沒有實績的新創公司估值被推上數十億美元。Google和其他AI公司也投入了數十億資金來建設新的資料中心,以訓練和運行AI模型,這引發市場擔心,泡沫可能說破就破。
不過,哈薩比斯認為即使 AI泡沫破裂,Google也能受到保護。因為公司已經在利用 AI強化Google地圖、Gmail和搜尋等產品。「當市場低迷時,人們會更依賴這些經過AI強化的核心工具;而當前景樂觀時,我們則擁有最廣泛的產品組合和最領先的開創性研究。」
哈薩比斯也正在利用AI來開發受歡迎的新工具,例如可以從書面材料自動生成 Podcast的NotebookLM,以及可以透過 AI 進行應用程式雛形設計的AI Studio。他們甚至在探索將這項技術嵌入到遊戲和機器人技術等領域。
近來,無論是在網路社群還是專業技術領域,一個引人矚目的觀點正日益盛行。Google 的AI技術實力幾乎就要與 OpenAI形成「黃金交叉」。
OpenAI旗下ChatGpt問世時,人們擔心 AI可能迅速取代常規搜尋。但生成式 AI目前似乎尚未蠶食 Google 利潤豐厚的搜尋業務。Alphabet最近財報提到,AI總覽(AI Overviews)反而推動了搜尋查詢量成長10% 。
史坦今天也提到,公司觀察到,視覺搜尋(依賴 Gemini 分析照片的能力)的使用量也激增70%。AI 圖像生成和編輯工具Nano Banana推出後,為Gemini應用程式帶來了史上最快的用戶增速,甚至讓Gemini App的用戶回訪率提升了兩倍以上。
彭博社先前也報導, Google即將與蘋果達成協議,將Gemini 用於 iPhone Siri。
Gemini 3聰明、簡潔,擺脫ChatGPT式贅詞風
與此同時,OpenAI最新的頂尖模型GPT-5在8月發布時卻有些令人失望。一些專家稱它表現平平,也有用戶抱怨它的語氣變得過於正式。
事實上,Google今天也順勢挖苦了一下OpenAI 。Google意有所指地說, Gemini 3 Pro不易陷入ChatGPT式的空洞奉承。使用者將明顯感受到Gemini 3 Pro回應風格的轉變,回答會更「聰明、簡潔且直接,不再用陳腔濫調與奉承填充內容,而是提供真正的洞見 —— 說你該知道的,而不只是你想聽的」。
Google也引用數據指出,Gemini 3在多個用戶評比模型網站上的評分超越了GPT-5和其他模型。
Google DeepMind技術長卡武庫格魯(Koray Kavukcuoglu)表示,兩大優勢幫助模型精進,分別是有6.5億月活躍用戶、1300萬開發者在使用Google的模型,Google可以透過互動和他們的反應進一步訓練和精進特定領域。
卡武庫格魯說,Google 設計的晶片和營運資料中心的能力也帶來優勢,因此「我們有一條龍的AI創新模式,將所有環節都整合起來,從領先業界的硬體基礎,到世界頂尖的研究、模型與開發工具,一直到能觸及全球數十億人的終端產品。」
(資料來源:WIRED, The Verge, Bloomberg, WSJ)
天下總主筆陳良榕專欄。半導體狂熱、科技巨頭謀略的最犀利解讀
看懂科技大勢,獨家解讀
請查看您的信箱,我們將寄送驗證信給您,確保未來信件會送到您的信箱