![]()
7月22日消息,Google正式發布三款全新Gemini模型,包括Gemini 3.6 Flash、Gemini 3.5 Flash-Lite和Gemini 3.5 Flash Cyber,進一步完善Gemini模型矩陣。與此前圍繞模型能力上限展開競爭不同,此次發布更加聚焦AI Agent時代開發者最關注的三個指標——效率、延遲和成本,希望幫助企業以更低成本構建和部署AI Agent。
Google表示,隨著越來越多開發者和企業開始構建生產級AI Agent,更高的Token利用率、更低的響應延遲以及更加穩定可靠的模型表現,正成為新的核心需求。Flash系列模型正是圍繞這一目標打造,在模型能力與運行效率之間尋求平衡,以支撐大規模Agent工作流。
此次更新中,Gemini 3.6 Flash成為新的主力模型。Google稱,該模型基于開發者對Gemini 3.5 Flash的反饋進行了優化,不僅提升了編程、知識處理和多模態能力,還進一步提高了Token利用效率。
官方數據顯示,在Artificial Analysis Index測試中,Gemini 3.6 Flash相比Gemini 3.5 Flash平均減少17%的輸出Token,同時完成復雜多步驟任務時需要更少的推理步驟和工具調用,從而降低整體Agent運行成本。模型價格也同步下調至每百萬輸入Token 1.5美元、每百萬輸出Token 7.5美元。
![]()
Google同時公布了一系列基準測試結果。在DeepSWE、MLE Bench等編程與機器學習評測中,Gemini 3.6 Flash均較上一代實現性能提升,并進一步降低了無效代碼修改和重復執行循環的情況。此外,新模型強化了針對化學、生物、放射性、核安全(CBRN)以及網絡攻擊等領域的安全防護能力,提高了抵御越獄攻擊(Jailbreak)的能力,同時盡可能減少對正常使用場景的誤拒絕。
除了主力模型,Google還推出了Gemini 3.5 Flash-Lite。
該模型定位于低延遲、高吞吐量場景,主要面向Agent搜索、文檔處理等需要大規模調用的企業應用。Google表示,Gemini 3.5 Flash-Lite是目前3.5系列中速度最快的模型,根據Artificial Analysis測算,其輸出速度可達到每秒350個Token。
價格方面,該模型進一步降低至每百萬輸入Token 0.3美元、每百萬輸出Token 2.5美元。官方稱,相較Gemini 3.1 Flash-Lite,新模型在編程、長上下文理解、Agent任務執行等多個基準測試中均有明顯提升,在部分Agent和編程評測中甚至超過Gemini 3 Flash。
Google表示,Gemini 3.5 Flash-Lite支持不同思考深度配置,開發者可以根據不同任務,在低延遲、低成本與復雜推理能力之間進行權衡。同時,該模型已內置Computer Use能力,可幫助開發者構建能夠跨瀏覽器、移動端和桌面環境執行任務的AI Agent。
第三款產品則瞄準網絡安全領域。
Google推出了專門針對網絡安全優化的Gemini 3.5 Flash Cyber。該模型基于Gemini 3.5 Flash訓練,并針對漏洞發現、驗證和自動修復進行了專項微調,旨在以較低成本完成軟件漏洞檢測和修復工作。
隨著三款新模型正式發布,Google也同步開放了相應產品。其中,Gemini 3.6 Flash和Gemini 3.5 Flash-Lite已上線Gemini API、Google AI Studio、Android Studio,并面向企業開放至Gemini Enterprise Agent Platform,同時也逐步集成至Gemini應用及Google搜索等產品中。
值得關注的是,Google在官方博客中還透露,Gemini 3.5 Pro目前仍在合作伙伴測試階段,將在準備就緒后正式發布。同時,公司已啟動Gemini 4迄今規模最大的預訓練工作。(定西)
