【DeepSeek发布V4.1 Flash:最小尺寸原生多模态模型,KV Cache大幅压缩降低Agent成本】
(1) 9月10日,DeepSeek正式发布DeepSeek V4.1 Flash模型,这是其全新模型结...
【DeepSeek发布V4.1 Flash:最小尺寸原生多模态模型,KV Cache大幅压缩降低Agent成本】
(1) 9月10日,DeepSeek正式发布DeepSeek V4.1 Flash模型,这是其全新模型结构系列中尺寸最小的模型,具备原生多模态视觉理解能力。
(2) 新一代模型大幅减少了KV Cache缓存大小:与上一代相比,对HBM的需求减少到1/4,对SSD的需求减少到1/8。
(3) 在Agent使用场景中,缓存命中费用占比较高,对KV Cache的压缩将大幅降低Agent类任务的使用成本。
编辑回复