大陸產經:DeepSeek發布V4.1 Flash模型,HBM與SSD需求降至上代25%及12.5%
財訊新聞 2026/09/10 14:18

【財訊快報/陳孟朔】專注於研發開源、高效且具備極致性價比的頂尖AI大模型中國新創公司DeepSeek週四(10日)正式發布DeepSeek V4.1 Flash,為公司全新模型架構系列中參數規模最小的版本,並具備原生多模態視覺理解能力。
DeepSeek表示,新模型透過大幅壓縮KV Cache容量,與上一代模型相比,高頻寬記憶體(HBM)需求降至四分之一,固態硬碟(SSD)需求更降至八分之一,有助降低模型部署所需的硬體資源。
KV Cache主要用於儲存模型推理過程中的中間運算結果,避免重複計算。尤其在AI代理(Agent)需要進行長時間、多輪互動的使用情境下,快取命中費用通常占比較高,因此壓縮KV Cache可明顯降低推理與代理任務成本。
不過,上述降幅是DeepSeek V4.1 Flash相較自家上一代模型的單一模型資源需求,不能直接推論整體AI產業對HBM與SSD的需求將同比例下降;最終影響仍取決於模型採用規模、推理流量及AI代理應用增長速度。
