Techub News 消息,DeepSeek AI 发布了 DeepSeek-V4.1-Flash 模型。该模型为多模态混合专家模型,拥有 5520 亿骨干参数和 1960 亿额外记忆参数,上下文窗口扩展至 100 万 token。其核心优化在于将全局 KV 缓存占用降至每 token 890 字节,约为 V4-Flash 的四分之一。 模型采用因果编码器-解码器架构,将预填充计算量减少近半。同时引入压缩稀疏注意力 2 代技术,并采用 FP4 量化 KV 缓存,进一步降低了存储需求。模型权重已在 Hugging Face 上以 MIT 许可证开源,并提供公开 API。 研究团队表示,该模型在保持与 DeepSeek-V4-Pro-Base 相当的世界知识和编码能力的同时,仅使用了后者三分之一的总体参数和四分之一的激活参数。单 token 解码的计算量在上下文从 4K 增长到 100 万时仅增加四分之一。(MarkTechPost)