DeepSeek 发布 DeepSeek-V3.2-Exp 实验模型并开源,API 同步降价超 50%
DeepSeek 正式发布实验性模型 DeepSeek-V3.2-Exp,引入细粒度稀疏注意力机制(DSA)以优化长文本训练与推理效率,官方各端已同步上线且 API 调用成本降低 50% 以上。
推荐理由:模型引入细粒度稀疏注意力机制提升长文本训练推理效率,同步开源模型权重与算子并将 API 调用成本降低 50% 以上。
新模型的发布、开源与迭代:大模型厂商的旗舰更新、开源权重放出、性能与价格变化的第一时间记录。
DeepSeek 正式发布实验性模型 DeepSeek-V3.2-Exp,引入细粒度稀疏注意力机制(DSA)以优化长文本训练与推理效率,官方各端已同步上线且 API 调用成本降低 50% 以上。
推荐理由:模型引入细粒度稀疏注意力机制提升长文本训练推理效率,同步开源模型权重与算子并将 API 调用成本降低 50% 以上。
DeepSeek 宣布 DeepSeek-V3.1 更新至 DeepSeek-V3.1-Terminus 版本,并在 Hugging Face 与 ModelScope 同步开源。
推荐理由:官方说明了该版本在语言一致性以及代码和搜索智能体上的针对性改进,并同步公开了开源权重与接口更新。