DeepSeek-V4-Pro-0813在硅基流动Day-0首发,主打1M上下文、低/高/最大三档推理强度,重心转向编码、工具调用与智能体工作流,维持MIT开源。定价为输入每百万token 1.32美元、输出3.96美元,缓存命中仅0.44美元,缓存成本优势显著。
DeepSeek V4正式版自7月中旬灰度测试后一度跳票,官方至今未公布发布时间。但硅基流动平台通知自8月3日起,将DeepSeek V4 Pro的缓存命中价格从每百万Token 0.1元大幅上调至1.0元。这一突兀涨价被外界视为DeepSeek V4正式版即将上线的重要信号,8月3日或成为发布节点。
国产AI芯片与大模型协同优化取得重要进展。摩尔线程与硅基流动基于国产GPU MTT S5000,成功完成对千亿参数大模型DeepSeek V3 671B的深度适配。通过应用FP8低精度推理技术,实现单卡预填充吞吐量超4000 tokens/秒,解码吞吐量超1000 tokens/秒,推理速度已接近国际主流高端AI加速器水平。
硅基流动平台上线阿里Qwen3-VL开源模型,该模型在视觉理解、时序分析和多模态推理方面显著进步。它能有效应对图像模糊、视频复杂等难题,提升视觉认知能力,支持32种语言OCR功能,准确处理弱视觉信息,帮助用户轻松处理复杂视觉任务。
Sensetime
-
输入tokens/百万
输出tokens/百万
上下文长度