DeepSeek V4.1 Flash 공식 출시: HBM 수요 1/4, SSD 수요 1/8로 감소 • 신규 모델 구조 시리즈… — 한투증권 미국/중국전략 정정영 — TG.ME

한투증권 미국/중국전략 정정영중국 대표 AI 기업 MINIMAX & Z.AI 9-10%대 급락 https://n.news.naver.com/article/422/0000904905?sid=104
DeepSeek V4.1 Flash 공식 출시: HBM 수요 1/4, SSD 수요 1/8로 감소

• 딥시크 신규 모델 구조 시리즈 중 가장 작은 크기의 모델. 네이티브 멀티모달 시각 이해 능력 갖추고 있음

• 차세대 모델은 KV 캐시 크기 대폭 축소. 이전 세대 모델에 비해 HBM 수요는 1/4, SSD 수요는 1/8로 감소

• 에이전트 사용 시나리오에서 캐시 히트 비용 높은 경향. KV 캐시 압축은 에이전트 클래스 작업 비용 크게 절감

DeepSeek V4.1 Flash模型正式发布:对HBM的需求减少到1/4,对SSD的需求减少到1/8
9月10日,DeepSeek正式发布DeepSeek V4.1 Flash模型。这是公司全新模型结构系列中的最小尺寸的模型,具备原生多模态视觉理解能力。据介绍,新一代模型大幅减少了KV Cache缓存的大小,与上一代模型相比,对HBM的需求减少到1/4,对SSD的需求减少到1/8。在Agent使用场景中,缓存命中的费用往往占比较高,对KV Cache的压缩大幅降低了Agent类任务的使用成本。


https://wallstreetcn.com/livenews/3163013?ivk=1#from=android
Wallstreetcn
DeepSeek V4.1 Flash模型正式发布:对HBM的需求减少到1/4,对SSD的需求减少到1/8 - 华尔街见闻
9月10日,DeepSeek正式发布DeepSeek V4.1 Flash模型。这是公司全新模型结构系列中的最小尺寸的模型,具备原生多模态视觉理解能力。据介绍,新一代模型大幅减少了KV Cache缓存的大小,与上一代模型相比,对HBM的需求减少到1/4,对SSD的需求减少到1/8。在Agent使用场景中,缓存命中的费用往往占比较高,对KV Cache的压缩大幅降低了Agent类任务的使用成本。
❤2
September 10, 2026 6.5K 101