DeepSeek近期动作密集:本周低调发布V4.1 Flash,虽未调整大版本号,但底层架构升级幅度已达V5级别;后续还将推出全新大模型Code2.0及V4.1 Pro系列,其架构换代与新品路线引发行业关注。
深度求索发布DeepSeek V4.1 Flash,为全新结构系列最小模型,具备原生多模态视觉理解。新结构旨在提升能力上限、推理速度与吞吐,并可扩展至更大参数。该模型为552B参数MoE,采用Causal-Encoder-Decoder不对称结构:输入激活仅8B,输出激活16B,HBM需求降至1/4,显著降低成本。
深度求索发布轻量级多模态模型DeepSeek V4.1Flash,为系列最小尺寸。其采用552B参数MoE架构,创新引入Causal-Encoder-Decoder结构,具备原生视觉理解能力,旨在提升能力上限、推理速度与吞吐量,并具备向更大模型扩展潜力。
DeepSeek宣布自2026年9月10日12时起调整Flash系列模型价格:空闲时段输入缓存命中、未命中和输出每百万Token分别为0.02元、1元、4元,高峰时段翻倍;三档价格全线下调,缓存命中降幅达60%。涉及deepseek-v4-flash及deepseek-v4-flash-vision-exp两款模型。
Openai
$2.8
输入tokens/百万
$11.2
输出tokens/百万
1k
上下文长度
Google
$0.49
$2.1
Xai
$1.4
$3.5
2k
$7.7
$30.8
200
-
Anthropic
$105
$525
$0.7
$7
$35
$17.5
$21
Alibaba
$4
$16
$1
$10
256
$2
$20
Baidu
128
$6
$24
Bytedance
$1.2
$3.6
4
Sci-fi-vy
DeepSeek-R1-0528是DeepSeek R1系列的小版本升级模型,通过增加计算资源和算法优化显著提升了推理深度和能力,在数学、编程等多个基准测试中表现出色。
rombodawg
EveryoneLLM系列模型由社区打造,为社区服务。这是一个基于deepseek-coder-33b-base微调而成的专用编码模型。