谷歌推三款輕量化Gemini AI模型 旗艦版延宕落後對手

商傳媒|葉安庭/綜合外電報導
谷歌旗下Google DeepMind週二推出三款全新人工智慧(AI)模型,分別是Gemini 3.6 Flash、Gemini 3.5 Flash-Lite以及Gemini 3.5 Flash Cyber。這些模型均屬於谷歌「Flash」系列,以速度快、成本低為主要特色,而非追求極致的推理深度,目標客群鎖定開發大規模AI代理的開發者。
此次發布顯示谷歌的戰略轉向,更側重小型、低成本、能同時執行多項任務的模型,而非依賴單一龐大且昂貴的模型。《Northeast Times》報導,Gemini 3.6 Flash被谷歌形容為新一代「主力模型」,能應用於程式開發、文件分析、圖表判讀與報告撰寫等任務。相較於前一代Gemini 3.5 Flash,Gemini 3.6 Flash的輸出Token使用量減少了17%,在DeepSWE基準測試中,Token使用量更可降低高達65%。谷歌在官方部落格中指出,Gemini 3.6 Flash在提高程式開發與知識型工作的效率之餘,也顯著提升了Token效率。
Gemini 3.5 Flash-Lite是Gemini 3.5系列中最快的模型,每秒可處理350個輸出Token。谷歌將其定價為每百萬輸入Token 0.30美元,每百萬輸出Token 2.50美元。這款模型專為處理大量任務而設計,例如搜尋大型文件集或同步執行多個小型AI任務。在SWE-Bench Pro測試中,Gemini 3.5 Flash-Lite得分為54.2%,優於舊版Gemini 3 Flash的49.6%;在OSWorld-Verified測試中,得分達74.0%,也高於Gemini 3 Flash的65.1%。Gemini 3.6 Flash與Gemini 3.5 Flash-Lite目前已可透過Gemini應用程式、Google搜尋、Google AI Studio、Android Studio與Gemini Enterprise等平台使用。
另一款專門模型Gemini 3.5 Flash Cyber,則基於Gemini 3.5 Flash進行微調,旨在找出並修復軟體安全漏洞。該模型整合於谷歌的程式碼安全代理程式CodeMender中運行,多個Flash Cyber代理可平行作業,最高可呼叫模型五次,並將發現的問題整合為一份報告。在谷歌內部的Big Sleep評估中,Flash Cyber在固定呼叫次數下,於V8 JavaScript引擎中發現了55個獨特的已確認問題,優於標準3.5 Flash的47個及Anthropic旗下Claude Opus 4.6的36個。
然而,考量到其潛在的濫用風險,谷歌已限制Gemini 3.5 Flash Cyber的存取權限,僅透過有限度的試點計畫,提供給各國政府和「信任合作夥伴」,不會向一般大眾開放。同時,谷歌至今仍未推出其最高性能模型Gemini 3.5 Pro。這款模型原定於今年五月的谷歌I/O開發者大會上揭露,並預計在隨後一個月推出。Google DeepMind產品負責人洛根·基爾帕特里克(Logan Kilpatrick)週二表示,目前谷歌正與合作夥伴測試3.5 Pro,希望該模型能「盡快落地」。旗艦模型的延遲可能讓谷歌在AI競爭中落後於OpenAI的GPT-5.5、GPT-5.6以及Anthropic的Claude Opus 4.8、Claude Sonnet 5、Fable 5等競爭對手。
對一般使用者而言,Gemini聊天機器人與Google搜尋中的AI功能將因此變得更快、成本更低。對開發者和企業而言,更低的價格和更高的速度,可能讓過去成本過高的工作流程得以大規模實現。谷歌證實已啟動Gemini 4的預訓練工作,並將其描述為「最具雄心」的訓練運行。