DeepSeek-V4-Pro-0813在硅基流动Day-0首发,主打1M上下文、低/高/最大三档推理强度,重心转向编码、工具调用与智能体工作流,维持MIT开源。定价为输入每百万token 1.32美元、输出3.96美元,缓存命中仅0.44美元,缓存成本优势显著。
韩国Upstage推出商用大模型Solar Pro4,具备512K上下文窗口,最高支持128K输出,单次会话可处理多份合同、报告及数据文件。定价颇具竞争力:每百万Tokens输入0.3美元,缓存读取0.06美元,输出1.2美元。
智谱创始人唐杰发内部信,宣布启动“摸高”计划,未来两年将战略投入长程任务、自治智能体系统、完全自我训练及极致安全治理四大核心引擎,全力冲击下一代通用人工智能(AGI)。同期,智谱发布了开源模型GLM-5.2,支持百万token上下文并在长程任务上保持领先,以MIT协议全量开源。
国内AI独角兽MiniMax即将发布新一代大模型M3,采用稀疏注意力架构,结合快速索引与精准计算,突破超长上下文计算瓶颈。AI工程负责人预告“Something BIG is coming!”,引发业界关注。
Openai
$2.8
输入tokens/百万
$11.2
输出tokens/百万
1k
上下文长度
Google
$0.49
$2.1
Xai
$1.4
$3.5
2k
Anthropic
$105
$525
200
$0.7
$7
$35
Alibaba
$4
$16
$2
$20
-
$6
$24
256
Bytedance
$0.8
$0.15
$1.5
Baidu
32
$10.5
Tencent
$1
$8
$0.75
$0.35
400
一个与AI代码编辑器集成的MCP服务器,通过Gemini 2.5的百万token上下文窗口和任务管理功能,优化Cursor的代理能力。