【leyu.com官網科技消息】谷歌近日正式發布Gemini 3.8 Flash,這是該公司在短短六周內推出的第三款Flash系列模型。與此前版本不同,此次發布包含兩個變體:面向通用場景的Gemini 3.8 Flash和專攻網絡安全的Gemini 3.8 Flash Cyber,分別定位為谷歌"最智能的主力工作模型"和"最強網絡安全模型"。
Gemini 3.8 Flash
從性能表現來看,Gemini 3.8 Flash在多個基準測試中展現出超越更大規模模型的能力。在衡量自主解決復雜工程問題能力的DeepSWE v1.1測試中,該模型得分73.7%,略低于Claude Opus 5的74%,但明顯優于Gemini 3.7 Flash、Claude Sonnet 5、GPT-5.6 Sol和GPT-5.6 Terra等競品。此外,在Vals Finance Agent v2金融分析、Harvey法律智能體基準、CharXiv Reasoning信息綜合、Terminal-bench 2.1終端編碼以及LVBench長視頻理解等多項測試中,Gemini 3.8 Flash同樣領先于上述對手。
谷歌解釋稱,3.8 Flash之所以表現更優,是因為該模型"工作更努力"。面對復雜任務時,它會主動執行額外的推理步驟以提升輸出質量,當然這也意味著在某些情況下會消耗更多token。定價方面,Gemini 3.8 Flash目前處于首發優惠期,輸入token價格為每百萬0.75美元,輸出token為每百萬3.75美元,后續將上調至1.50美元和7.50美元。即便如此,其價格仍低于Claude Opus 5和GPT-5.6 Sol等同類產品。
Gemini 3.8 Flash Cyber則是一款更為特殊的模型,目前僅通過谷歌新設立的Fairr:破高膙轔?f然揩襮嫛蟿F鳩5pep=k?確矅?鷜%?疆淴恤4G?緬暑皚`x鵏 ]]穸?頺t諏?鷓?$% 燾???烊所?炎m豩=2(?r蜨R庀汬}T廞 ??ヱq鵒黮}劷:q{|?e ?%坖D覑眤丬鯇M(纈s6/搇t巗紹g.晾飽S閽?dt邊潫Lg妔譫ind計劃向特定用戶開放,包括可信政府機構、關鍵基礎設施運營商以及軟件維護人員。在C/C++漏洞檢測的行業標準測試中,該模型得分86.2%,超過前代Gemini 3.5 Flash Cyber以及Mythos 5、GPT-5.5-Cyber等更大規模的模型。在覆蓋20多種編程語言的真實漏洞發現場景中,其成功率達到71%,大幅高于Gemini 3.7 Flash的58.9%和Gemini 3.5 Flash Cyber的46.6%。
該網絡安全模型的另一大亮點在于自動化補丁生成能力。據谷歌公布的數據,Gemini 3.8 Flash Cyber為Chrome瀏覽器漏洞生成的正確補丁數量,是"規模大得多的最佳商用模型"的2.6倍。對于普通用戶而言,雖然不會直接與這一模型交互,但其在防御端和開發端的改進將間接提升日常使用的技術產品的安全性。
目前,Gemini 3.8 Flash已向開發者、企業客戶以及Google AI Pro和Ultra訂閱用戶開放。Gemini 3.8 Flash Cyber的訪問權限則僅限于Fairr:破高膙轔?f然揩襮嫛蟿F鳩5pep=k?確矅?鷜%?疆淴恤4G?緬暑皚`x鵏 ]]穸?頺t諏?鷓?$% 燾???烊所?炎m豩=2(?r蜨R庀汬}T廞 ??ヱq鵒黮}劷:q{|?e ?%坖D覑眤丬鯇M(纈s6/搇t巗紹g.晾飽S閽?dt邊潫Lg妔譫ind計劃成員。
版權所有,未經許可不得轉載
-leyu.com官網