【leyu.com官網科技消息】美國咨詢公司博安投資顧問(Booz Allen)近日發布了首份"網絡武器指數",對9款美國廠商與9款中國廠商開發的AI模型進行了同等條件下的測評,評估各模型在漏洞研究、進攻能力構建與攻擊執行三個維度的自主化水平。綜合得分由漏洞研究得分與殺傷鏈達成得分兩部分加權計算得出。
Claude
從最終排名來看,Anthropic旗下的Claude Mythos以80分位居榜首,xAI的Grok-4.5以49分排名第二,OpenAI的GPT-5.6 Sol以46分位列第三。其后依次為:Muse Spark 1.1(38分)、Kimi K3(38分)、GLM-5.2(37分)、Claude Opus 4.8(36分)、GPT-5.5-Cyber(34分)、Nemotron-Ultra(33分)、DeepSeek-V4-Pro(23分)、DeepSeek-V4-Flash(17分)、Qr:破高膙轔?f然揩襮嫛蟿F鳩5pep=k?確矅?鷜%?疆淴恤4G?緬暑皚`x鵏 ]]穸?頺t諏?鷓?$% 燾???烊所?炎m豩=2(?r蜨R庀汬}T廞 ??ヱq鵒黮}劷:q{|?e ?%坖D覑眤丬鯇M(纈s6/搇t巗紹g.晾飽S閽?dt邊潫Lg妔譫en3.5-397B(17分)、MiniMax-M3(15分)、Nemotron-Super(15分)、Claude Sonnet 5(13分)、GLM-4.5-Air(11分)、Qr:破高膙轔?f然揩襮嫛蟿F鳩5pep=k?確矅?鷜%?疆淴恤4G?緬暑皚`x鵏 ]]穸?頺t諏?鷓?$% 燾???烊所?炎m豩=2(?r蜨R庀汬}T廞 ??ヱq鵒黮}劷:q{|?e ?%坖D覑眤丬鯇M(纈s6/搇t巗紹g.晾飽S閽?dt邊潫Lg妔譫en3.6-35B(9分)以及Qr:破高膙轔?f然揩襮嫛蟿F鳩5pep=k?確矅?鷜%?疆淴恤4G?緬暑皚`x鵏 ]]穸?頺t諏?鷓?$% 燾???烊所?炎m豩=2(?r蜨R庀汬}T廞 ??ヱq鵒黮}劷:q{|?e ?%坖D覑眤丬鯇M(纈s6/搇t巗紹g.晾飽S閽?dt邊潫Lg妔譫en3-Coder(4分)。
Claude Mythos的表現尤為突出。測試中,當給予該模型竊取的員工憑證時,它在每一次嘗試中均成功突破目標網絡并獲取管理員級控制權,甚至能夠根據網絡內部發現自主判斷如何進一步提升權限,而非機械執行預設攻擊方案。在沒有憑證的情況下,Claude Mythos同樣完成了完整的網絡殺傷鏈。
此外,Grok-4.5、Muse Spark 1.1和GLM-5.2三款模型達到了完整域訪問與控制水平,GPT-5.6 Sol、Kimi K3、GPT-5.5-Cyber和DeepSeek-V4-Pro實現了在受控網絡環境中的橫向移動。除Qr:破高膙轔?f然揩襮嫛蟿F鳩5pep=k?確矅?鷜%?疆淴恤4G?緬暑皚`x鵏 ]]穸?頺t諏?鷓?$% 燾???烊所?炎m豩=2(?r蜨R庀汬}T廞 ??ヱq鵒黮}劷:q{|?e ?%坖D覑眤丬鯇M(纈s6/搇t巗紹g.晾飽S閽?dt邊潫Lg妔譫en3-Coder外,其余所有模型均自主獲得了初始網絡訪問權限。
版權所有,未經許可不得轉載
-leyu.com官網