资讯🔥7.0

【明日主题前瞻】DeepSeek V4.1 Flash发布:具备原生多模态视觉理解能力

财联社深度·2026/9/10 13:28:37🔗 原文

📋总体概括

DeepSeek正式发布新模型结构系列中尺寸最小的DeepSeek V4.1 Flash,具备原生多模态视觉理解能力。新模型大幅压缩KV Cache,HBM需求降至上一代的1/4,SSD需求降至1/8,显著降低Agent类任务的缓存命中成本。券商认为国产大模型技术迭代与商业化能力持续强化,或推动模型价格下降,扩大下游AI应用落地空间;同日AI制药、功率半导体、算力基建等亦有产业动态。

关键信息

  • DeepSeek发布V4.1 Flash,为新模型结构系列中最小尺寸模型,具备原生多模态视觉理解能力
  • KV Cache大幅压缩后,HBM需求仅为上一代1/4,SSD需求为1/8
  • 缓存命中费用占Agent类任务成本较高,KV Cache压缩直接降低Agent使用成本
  • 券商观点:国产开源模型商业化强化,或推动模型降价,利好下游AI应用落地
  • 同日热点还包括AI制药三期临床入组、瑞萨调价、北京布局智能算力等

🔥犀利点评

这次真正的看点不是多模态本身——而是砍KV Cache带来的推理成本暴降。HBM降到1/4、SSD降到1/8,等于直接打价格战的地基。当开源模型把推理成本打到地板上,率先受伤的是靠token差价吃饭的API厂商,真正受益的是被成本卡住脖子的Agent应用。资本市场盯着题材炒作可以理解,但这场变革的本质是:算力需求结构在变,别把省下来的钱都算成AI芯片的增量。

本文由本站自动聚合,以下为原始来源:前往 财联社深度 阅读全文