【leyu.com官網(wǎng)科技消息】DeepSeek近日發(fā)布新一代AI模型V4.1-Flash。按照官方介紹,V4.1-Flash雖然總參數(shù)規(guī)模和激活參數(shù)均低于V4-Pro,但在性能、推理速度和成本控制方面表現(xiàn)更突出,尤其在智能體和編程相關(guān)任務(wù)上,部分基準(zhǔn)測(cè)試成績(jī)超過(guò)V4-Pro以及GPT-5.6 Sol等部分前沿模型。
DeepSeek
leyu.com官網(wǎng)科技注意到,V4.1-Flash采用專家混合架構(gòu),總參數(shù)為5520億,輸入階段激活參數(shù)為80億,輸出階段為160億。相比之下,上一代V4-Flash總參數(shù)為2840億,V4-Pro總參數(shù)則達(dá)到1.6萬(wàn)億。該模型的一項(xiàng)重點(diǎn)改進(jìn)是大幅壓縮KV緩存,緩存占用降至每個(gè)token約890字節(jié),同時(shí)輸出速度達(dá)到每秒約214.4個(gè)token,首個(gè)token響應(yīng)時(shí)間為1.13秒。獨(dú)立評(píng)測(cè)機(jī)構(gòu)AA給出了“速度顯著較快”的評(píng)價(jià)。

在性能方面,DeepSeek稱,V4.1-Flash在高推理強(qiáng)度設(shè)置下,于終端操作、代碼修復(fù)和自動(dòng)化任務(wù)等測(cè)試中領(lǐng)先于GPT 5.6 Sol和Claude Opus 5。不過(guò)在更廣泛的高難度通用推理任務(wù)中,該模型成績(jī)相對(duì)一般。AA數(shù)據(jù)顯示,V4.1-Flash的綜合智能指數(shù)為40分,高于多數(shù)同類開(kāi)源權(quán)重模型中位水平,但仍低于頭部前沿模型。需要注意的是,AA近期升級(jí)了評(píng)測(cè)體系,整體評(píng)分標(biāo)準(zhǔn)明顯收緊,不少高分模型的分?jǐn)?shù)也出現(xiàn)下調(diào)。

價(jià)格方面,AA數(shù)據(jù)顯示,V4.1-Flash每100萬(wàn)輸入token價(jià)格為0.3美元,每100萬(wàn)輸出token價(jià)格為1.2美元,綜合成本約0.184美元,低于同檔模型中位數(shù)。若命中緩存,價(jià)格可進(jìn)一步降至每100萬(wàn)token 0.006美元。AA同時(shí)指出,該模型回答偏長(zhǎng),評(píng)測(cè)中輸出token總量明顯高于同類模型,可能對(duì)實(shí)際使用中的時(shí)間和費(fèi)用帶來(lái)影響。
技術(shù)層面,V4.1-Flash引入名為CED的新結(jié)構(gòu),將40層Transformer拆分為20層因果編碼器和20層解碼器,減少傳統(tǒng)交叉注意力帶來(lái)的重復(fù)計(jì)算,并結(jié)合CSA2、FP4量化等方法壓縮緩存與內(nèi)存占用。
整體來(lái)看,DeepSeek此次更新重點(diǎn)放在智能體執(zhí)行、代碼能力和部署成本優(yōu)化上。
版權(quán)所有,未經(jīng)許可不得轉(zhuǎn)載
-leyu.com官網(wǎng)