快科技7月23日消息,當地時間7月21日,谷歌旗下DeepMind對外推出三款全新Gemini輕量化模型,包含Gemini 3.6 Flash、Gemini 3.5 Flash-Lite以及行業專用模型Gemini 3.5 Flash Cyber。
與此同時,旗艦模型Gemini 3.5 Pro依然沒有露面成為此次焦點。
而據第三方評測榜單數據顯示,谷歌當前主力Gemini系列綜合實力已經跌至全球榜單十名以外,在頭部大模型競速賽道中顯現壓力。
據官方披露信息,三款新模型定位清晰,主要面向規模化商用場景。
其中Gemini 3.6 Flash是主力模型,與上一代相比能使用更少的token,在相同成本下提供更高質量的工作;而Gemini 3.5 Flash-Lite則是快速、成本效益高的選項,適用于日常任務,如處理文檔和搜索;Gemini 3.5 Flash Cyber是一種網絡安全模型,專為發現和修補關鍵軟件漏洞而構建。
但根據評測來看,此次谷歌的新模型在智能上并不出色,AI模型評測平臺Arena.ai的研究顯示,Gemini 3.6 Flash在前端代碼競技場中以1537分排名第12位。
![]()
而國內月之暗面最新發布的Kimi K3以1677分位列榜首,智譜GLM-5.2位列第四,Anthropic的Claude和OpenAI的GPT的多款系列產品位居前列。
![]()
第三方評測機構Artificial Analysis給出的結論是,Gemini 3.6 Flash在智能方面較3.5 Flash沒有提升,智能指數得分50,但任務效率有所提高,Gemini 3.6 Flash的平均每任務時間為 1.3 分鐘,較上一代減少超過50%,同時每任務成本略有降低。
這意味著,谷歌優化的更多是速度和成本,而不是模型能力本身。
而除了排行榜,開發者社區的反饋同樣出現明顯分化,不少開發者用谷歌新模型做任務時未看到很好的表現:"前端能力糟糕、空間推理也很差,我安慰自己這其實不是在高思考水平上運行的,但我不確定。"
有開發者評論道:"谷歌就像龜兔賽跑里的兔子,領先一段時間后就開始睡覺。"也有人直言,Gemini團隊需要引入真正關心交付前沿模型的人。
![]()
特別聲明:以上內容(如有圖片或視頻亦包括在內)為自媒體平臺“網易號”用戶上傳并發布,本平臺僅提供信息存儲服務。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.