我們的最新 Gemini 模型提供高效能、低延遲和高可靠性,能大規模建構 AI 代理。
開發者和客戶在建構生產級 AI 代理時,需要更高的 Token 效率、更低的延遲和更可靠的效能。我們的 Flash 系列模型旨在達到效率與品質的最佳平衡,以實現 AI 代理工作流程的規模化。
在 Gemini 3.5 Flash 的基礎上,我們推出了全新的 Gemini 模型:3.6 Flash、3.5 Flash-Lite,以及整合在 CodeMender 中的 3.5 Flash Cyber。
3.6 Flash 是我們的主力模型,提供更優異的編碼、知識工作和多模態效能。根據 Artificial Analysis Index,它比 3.5 Flash 減少了 17% 的輸出 Token 使用量,在 Datacurve 的 DeepSWE 等某些基準測試中,甚至觀察到高達 65% 的減少,同時每個輸出 Token 的成本更低。
這種提升的效率也伴隨著比 3.5 Flash 更低的價格。3.6 Flash 的輸入 Token 價格為每百萬 $1.50,輸出 Token 價格為每百萬 $7.50,降低了每個 AI 代理任務的總體成本,使建構和運行 AI 代理更具成本效益。
即使效率更高,3.6 Flash 在各種使用案例中仍比 3.5 Flash 展現出效能提升。在 DeepSWE 中,3.6 Flash 顯示出更高的精確度,減少了不必要的程式碼編輯和執行循環(49% 對 37%),並在 MLE Bench 中顯示出機器學習研究的顯著改進(63.9% 對 49.7%)。
它在 OSWorld-Verified 中顯示出改進的電腦使用能力(83.0% 對 78.4%)。現在,透過 Gemini API 和 Gemini Enterprise,電腦使用已成為內建的客戶端工具。
在 GDPval-AA v2 等基準測試中,它在知識工作方面超越了 3.5 Flash(1421 對 1349)。Hebbia 和 Harvey 等客戶發現它在文件解析、圖表和數據分析以及報告起草等多模態任務中表現出色。
3.6 Flash 配備了增強的「前沿安全」防護措施,涵蓋化學、生物、放射性、核能(CBRN)以及網路攻擊濫用等領域。這些防護措施使模型更能抵抗「越獄」攻擊,同時也盡量減少了對有益用途的拒絕。
除了 Flash 系列,我們也發布了 Gemini 3.5 Flash-Lite,專為低延遲任務以及開發者工作流程中高吞吐量至關重要的任務而設計,例如 AI 代理搜尋和文件處理。
3.5 Flash-Lite 是 3.5 系列中最快的模型。根據 Artificial Analysis 的測量,它能以每秒 350 個輸出 Token 的速度運行。定價為每百萬輸入 Token $0.3,每百萬輸出 Token $2.5,並且品質顯著優於 3.1 Flash-Lite,3.5 Flash-Lite 為運行高吞吐量生產流量的開發者和客戶提供了強大的性價比。
3.5 Flash-Lite 能夠有效率地擴展 AI 代理系統。在各種思考層級上,該模型顯著超越了 3.1 Flash-Lite。開發者可以根據工作負載配置模型,以優先處理低延遲、低成本的高吞吐量任務,或啟用更高的思考層級來處理多步驟的子代理工作負載。該模型現在也將電腦使用作為內建工具,以可靠地支援跨介面的 AI 代理任務。
在 Terminal-Bench 2.1 中,它在編碼和 AI 代理任務方面取得了顯著進步(54% 對 31%);在 GDM-MRCR v2 中,長上下文處理能力也大幅提升(72.2% 對 60.1%);在 GDPval-AA v2 中,實際任務執行能力亦有顯著增強(1140 對 642)。
事實上,在許多 AI 代理和編碼評估中,3.5 Flash-Lite 甚至超越了 3 Flash,包括 SWE-Bench Pro(54.2% 對 49.6%)和 OSWorld-Verified(74.0% 對 65.1%),使其成為處理 2.5 和 3 Flash 工作負載更快、更強大的選擇。
AI 模型已能比現有系統更快地發現安全漏洞。為應對這一日益增長的威脅,需要一種高效且強大的軟體安全方法。Flash 的效能和效率使其成為大規模檢測、驗證和修補程式碼安全問題的理想基礎。
Gemini 3.5 Flash Cyber 建基於 3.5 Flash,並經過微調,專門用於發現和修復網路安全漏洞,且每個 Token 的價格比大型模型更低。在 CodeMender 中,多個 3.5 Flash Cyber 代理協同工作以生成單一綜合報告,3.5 Flash Cyber 在流行的 CyberGym 基準測試中達到了領先的競爭效能。
考量到這項技術的雙重用途性質,我們對部署 3.5 Flash Cyber 採取了審慎的態度。該模型將很快透過 CodeMender,作為有限存取試點計畫的一部分,專門提供給政府和受信任的合作夥伴。這將使第一線防禦者能夠在關鍵漏洞被利用之前搶先發現並修復,同時減輕更廣泛的濫用風險。
Gemini 3.5 Pro 目前正在與合作夥伴進行測試,我們計劃在準備就緒後廣泛推出。同時,我們的團隊也已專注於建構下一代模型。我們已經啟動了迄今為止最雄心勃勃的 Gemini 4 預訓練,並對其進展感到興奮。
3.6 Flash 和 3.5 Flash-Lite 即日起開放使用:開發者可透過 Google AI Studio 和 Android Studio 中的 Gemini API 存取。3.6 Flash 也可在 Google Antigravity 中使用。
企業用戶可在 Gemini Enterprise Agent Platform 中使用,3.6 Flash 也可在 Gemini Enterprise 應用程式中使用。一般大眾則可透過 Gemini 應用程式使用,3.5 Flash-Lite 也將陸續整合至 Google 搜尋。
我們歡迎您在使用 3.6 Flash 和 3.5 Flash-Lite 後提供回饋,以改進未來的 Gemini 模型,並期待很快發布 3.5 Pro。



