DeepSeek V4.1 Flash 공식 출시: HBM 수요 1/4, SSD 수요 1/8로 감소
• 딥시크 신규 모델 구조 시리즈 중 가장 작은 크기의 모델. 네이티브 멀티모달 시각 이해 능력 갖추고 있음
• 차세대 모델은 KV 캐시 크기 대폭 축소. 이전 세대 모델에 비해 HBM 수요는 1/4, SSD 수요는 1/8로 감소
• 에이전트 사용 시나리오에서 캐시 히트 비용 높은 경향. KV 캐시 압축은 에이전트 클래스 작업 비용 크게 절감
DeepSeek V4.1 Flash模型正式发布:对HBM的需求减少到1/4,对SSD的需求减少到1/8
9月10日,DeepSeek正式发布DeepSeek V4.1 Flash模型。这是公司全新模型结构系列中的最小尺寸的模型,具备原生多模态视觉理解能力。据介绍,新一代模型大幅减少了KV Cache缓存的大小,与上一代模型相比,对HBM的需求减少到1/4,对SSD的需求减少到1/8。在Agent使用场景中,缓存命中的费用往往占比较高,对KV Cache的压缩大幅降低了Agent类任务的使用成本。
https://wallstreetcn.com/livenews/3163013?ivk=1#from=android
Wallstreetcn
DeepSeek V4.1 Flash模型正式发布:对HBM的需求减少到1/4,对SSD的需求减少到1/8 - 华尔街见闻
9月10日,DeepSeek正式发布DeepSeek V4.1 Flash模型。这是公司全新模型结构系列中的最小尺寸的模型,具备原生多模态视觉理解能力。据介绍,新一代模型大幅减少了KV Cache缓存的大小,与上一代模型相比,对HBM的需求减少到1/4,对SSD的需求减少到1/8。在Agent使用场景中,缓存命中的费用往往占比较高,对KV Cache的压缩大幅降低了Agent类任务的使用成本。

2September 10, 2026 6.5K 101