專注于工業領域,不斷創新,為客戶提供更加專業、優質、先進的產品和服務
【okooo澳客官網科技消息】DeepSeek近日發布新一代AI模型V4.1-Flash。按照官方介紹,V4.1-Flash雖然總參數規模和激活參數均低于V4-Pro,但在性能、推理速度和成本控制方面表現更突出,尤其在智能體和編程相關任務上,部分基準測試成績超過V4-Pro以及GPT-5.6 Sol等部分前沿模型。
DeepSeek
okooo澳客官網科技注意到,V4.1-Flash采用專家混合架構,總參數為5520億,輸入階段激活參數為80億,輸出階段為160億。相比之下,上一代V4-Flash總參數為2840億,V4-Pro總參數則達到1.6萬億。該模型的一項重點改進是大幅壓縮KV緩存,緩存占用降至每個token約890字節,同時輸出速度達到每秒約214.4個token,首個token響應時間為1.13秒。獨立評測機構AA給出了“速度顯著較快”的評價。

在性能方面,DeepSeek稱,V4.1-Flash在高推理強度設置下,于終端操作、代碼修復和自動化任務等測試中領先于GPT 5.6 Sol和Claude Opus 5。不過在更廣泛的高難度通用推理任務中,該模型成績相對一般。AA數據顯示,V4.1-Flash的綜合智能指數為40分,高于多數同類開源權重模型中位水平,但仍低于頭部前沿模型。需要注意的是,AA近期升級了評測體系,整體評分標準明顯收緊,不少高分模型的分數也出現下調。

價格方面,AA數據顯示,V4.1-Flash每100萬輸入token價格為0.3美元,每100萬輸出token價格為1.2美元,綜合成本約0.184美元,低于同檔模型中位數。若命中緩存,價格可進一步降至每100萬token 0.006美元。AA同時指出,該模型回答偏長,評測中輸出token總量明顯高于同類模型,可能對實際使用中的時間和費用帶來影響。
技術層面,V4.1-Flash引入名為CED的新結構,將40層Transformer拆分為20層因果編碼器和20層解碼器,減少傳統交叉注意力帶來的重復計算,并結合CSA2、FP4量化等方法壓縮緩存與內存占用。
整體來看,DeepSeek此次更新重點放在智能體執行、代碼能力和部署成本優化上。
版權所有,未經許可不得轉載
-okooo澳客官網