[谷歌] 谷歌連發叁款"Lite、Flash"模型,但Pro再次缺席

文丨曉靜
編輯丨徐青陽
美國當地時間7月21日,谷歌DeepMind團隊壹口氣放出叁款新的Gemini模型:Gemini 3.6 Flash、Gemini 3.5 Flash-Lite以及Gemini 3.5 Flash Cyber。
其中,主力模型Gemini 3.6 Flash在編碼和多模態任務上表現更強,但更關鍵的是,它處理相同工作所消耗的輸出token比前代減少了17%到65%。
Gemini 3.5 Flash-Lite主打極致的速度與性價比,每秒可生成350個輸出token。
而Gemini 3.5 Flash Cyber則是壹款針對網絡安全漏洞檢測與修復進行微調的專用模型,目前僅向政府和特定合作伙伴開放。

與此同時,外界期待已久的旗艦模型Gemini 3.5 Pro依然沒有露面,谷歌表示它正在與合作伙伴進行測試,並首次透露,更龐大的Gemini 4預訓練工作已經啟動。
01 告別“啰嗦′^腁I
在大語言模型的應用成本中,輸出token的數量直接關聯到費用與延遲。Gemini 3.6 Flash的設計目標之壹,就是降低這種不必要的消耗,同時保持或增強任務完成的質量。
第叁方基准測試機構Artificial Analysis Index的實測顯示,該模型輸出token使用量較前代降低了17%。在需要多步驟推理和工具調用的復雜工程任務中,節省效果更為明顯。

例如在Datacurve的DeepSWE基准測試中,token消耗減少了65%,這意味著Gemini 3.6 Flash在完成任務時執行了更少的冗余代碼編輯和循環操作。

[加西網正招聘多名全職sales 待遇優]
| 分享: |
| 注: | 在此頁閱讀全文 |
| 延伸閱讀 | 更多... |
推薦: