深度求索发布DeepSeek V4.1 Flash,为全新结构系列最小模型,具备原生多模态视觉理解。新结构旨在提升能力上限、推理速度与吞吐,并可扩展至更大参数。该模型为552B参数MoE,采用Causal-Encoder-Decoder不对称结构:输入激活仅8B,输出激活16B,HBM需求降至1/4,显著降低成本。
深度求索发布轻量级多模态模型DeepSeek V4.1Flash,为系列最小尺寸。其采用552B参数MoE架构,创新引入Causal-Encoder-Decoder结构,具备原生视觉理解能力,旨在提升能力上限、推理速度与吞吐量,并具备向更大模型扩展潜力。