會員
財金新聞Finance

DeepSeek發布最新小型模型 KV Cache緩存大幅減少

深度求索DeepSeek正式發布旗下最新小呎吋模型DeepSeek V4.1 Flash,具備原生多模態視覺理解能力,大幅減少KV Cache緩存的大小,與上一代模型相比,對HBM的需求減少到四分之一,對SSD的需求減少到八分之一。

在Agent使用場景中,緩存命中的費用往往佔比較高,對KV Cache的壓縮,大幅降低Agent類任務的使用成本。