跳到正文
原文
DeepSeek 公众号·· 20 天前精选AI 评分89

DeepSeek 正式发布 V4.1 Flash 原生多模态模型并开源

DeepSeek V4.1 Flash:更强、更快、更普惠

AI 导读

深度求索正式发布并开源 552B 参数的原生多模态模型 DeepSeek V4.1 Flash。该模型采用 Causal-Encoder-Decoder 非对称 MoE 结构,输入激活 8B、输出激活 16B,大幅减少了 KV Cache 对 HBM 和 SSD 的占用需求。

推荐理由

原文公开了非对称 MoE 架构与大幅压缩 KV Cache 的技术细节,为开发者评估多模态与 Agent 任务落地成本提供了直接参考。

来源:DeepSeek 公众号 · mp.weixin.qq.com