Google 推出 Gemini 3.6 Flash 等三款新模型!3.5 Flash-Lite 飆出極速,Gemini 4 預訓練已啟動

據 Google 官方部落格公告,Google 於 21 日正式推出新一代 Flash 系列模型,包含 Gemini 3.6 Flash、3.5 Flash-Lite 以及 3.5 Flash Cyber。新模型專為 AI 代理(AI agents)工作流打造,不僅大幅降低輸出成本與代幣消耗,更內建了強大的電腦操作能力,全面劍指企業級的大規模生產部署。
(前情提要:Google 傳推出全新「frozen」晶片效能狂飆 10 倍!Alphabet 市值暴增 1150 億鎂)
(背景補充:Gemini 3.5 Pro 難產數月:Google 政治派系內鬥讓員工備感挫折)

本文目錄

Toggle

  • Gemini 3.6 Flash:效能大躍進,輸出成本更低
  • 3.5 Flash-Lite:極致輕量化,飆出 350 tokens/s 高速
  • 專攻網路安全,Gemini 4 預訓練已啟動

隨著人工智慧(AI)技術邁入代理化(Agentic)時代,大型語言模型在速度、成本與推理能力上的平衡,已成為企業採用的關鍵考量。台北時間 2026 年 7 月 21 日,Google 團隊產品管理資深總監 Tulsee Doshi 發表官方文章,宣布推出基於先前用戶反饋所打造的三款全新 Flash 系列模型,進一步鞏固其在 AI 代理領域的基礎設施優勢。

Gemini 3.6 Flash:效能大躍進,輸出成本更低

作為新一代的主力工作模型,Gemini 3.6 Flash 在程式碼編寫、知識工作與多模態任務上的表現獲得了顯著提升。數據顯示,該模型在電腦使用能力評測(OSWorld-Verified)中達到了 83.0% 的高分,且相關的電腦使用工具現已直接內建於 Gemini API 與企業版中。

此外,3.6 Flash 大幅優化了代幣(Token)的使用效率。根據 Artificial Analysis Index 顯示,其輸出代幣使用量比前代減少了 17%,在某些基準測試(如 DeepSWE)中最高甚至可減少 65%。這不僅減少了多步驟工作流的推理與工具呼叫時間,也讓定價更具競爭力 —— 輸入為每百萬代幣 1.50 美元,輸出為 7.50 美元。

3.5 Flash-Lite:極致輕量化,飆出 350 tokens/s 高速

針對需要低延遲與高吞吐量的任務(例如代理搜尋與文件處理),Google 推出了專屬的 Gemini 3.5 Flash-Lite。該模型的輸出速度高達每秒 350 個代幣,且輸入成本極低,僅需每百萬代幣 0.3 美元(輸出為 2.5 美元)。

儘管定位為輕量級,3.5 Flash-Lite 的品質卻遠超先前的 Lite 世代。其支援可調整的「思考級別(thinking levels)」,讓開發者能在低思考模式與處理複雜子代理工作流的高思考模式之間自由切換。在長上下文與代理編碼評測中,它甚至超越了標準版的 Gemini 3 Flash 模型。

專攻網路安全,Gemini 4 預訓練已啟動

在本次更新中,Google 也針對特定的安全防禦場景,發布了基於 3.5 Flash 微調的「Gemini 3.5 Flash Cyber」模型。該模型能搭配多代理系統 CodeMender 協作產生綜合報告,協助防禦者快速發現並修復網路安全漏洞。然而,考量到這類技術的雙重用途風險,目前僅限政府機構與受信任的合作夥伴透過試點計畫進行有限存取。

Doshi 在文末也預告,除了正與合作夥伴測試即將廣泛推出的 Gemini 3.5 Pro 外,Google 目前已正式啟動了 Gemini 4 的預訓練工作,並形容這是該公司「最雄心勃勃」的計畫。即日起,開發者已可透過 Gemini API 等管道存取全新的 3.6 Flash 與 3.5 Flash-Lite 模型,搶先體驗 AI 代理工作流的強大潛力。

此頁面可能包含第三方內容,僅供參考(非陳述或保證),不應被視為 Gate 認可其觀點表述,也不得被視為財務或專業建議。詳見聲明
  • 打賞
  • 回覆
  • 轉發
  • 分享
回覆
請輸入回覆內容
請輸入回覆內容
暫無回覆
  • 已置頂