深度求索发布DeepSeek V4.1 Flash,为全新结构系列最小模型,具备原生多模态视觉理解。新结构旨在提升能力上限、推理速度与吞吐,并可扩展至更大参数。该模型为552B参数MoE,采用Causal-Encoder-Decoder不对称结构:输入激活仅8B,输出激活16B,HBM需求降至1/4,显著降低成本。
DeepSeek宣布自2026年9月10日12时起调整Flash系列模型价格:空闲时段输入缓存命中、未命中和输出每百万Token分别为0.02元、1元、4元,高峰时段翻倍;三档价格全线下调,缓存命中降幅达60%。涉及deepseek-v4-flash及deepseek-v4-flash-vision-exp两款模型。
谷歌六周内密集推出三款Flash模型,最新Gemini 3.8 Flash被寄予厚望,主攻长周期软件工程、自主Agent和复杂企业工作流,填补Pro系列空缺。官方基准测试表现亮眼,尤其在DeepSWE v1.1等长周期软件工程测试中成绩突出。
7月21日,谷歌DeepMind发布三款中轻量级AI模型。主力Gemini 3.6 Flash增强代码、知识及多模态能力,Token用量减少17%以降低成本;3.5 Flash-Lite主打极致性价比;3.5 Flash Cyber专攻网络安全。系列全面提升效率与应用落地。
Openai
$2.8
Input tokens/M
$11.2
Output tokens/M
1k
Context Length
Google
$0.49
$2.1
Xai
$1.4
$3.5
2k
$7.7
$30.8
200
-
Anthropic
$105
$525
$0.7
$7
$35
$17.5
$21
Alibaba
$4
$16
$1
$10
256
$2
$20
Baidu
128
$6
$24
$8
$240
52
Bytedance
$1.2
$3.6
4