智谱发布GLM-5.3,基座模型完全未变,提升全部来自后训练Scaling。通过数十倍规模长程任务环境、更丰富环境类型和超长后训练时间,相同基座智能上界被显著抬高。内部评测编程体感较GLM-5.2提升约50%,成为当前编程能力最强的开源模型,公开基准表现同样亮眼。
7月28日,月之暗面发布Kimi K3模型权重及技术报告,同步开源MoonEP、FlashKDA和AgentEnv三项关键基础设施技术。Kimi K3为目前最强模型,采用MoE架构,总参数达2.8万亿。这三项技术为大规模训练的效率、稳定性及智能体任务执行,提供了核心底层支撑。
DeepSeek投资者交流会内部谈话流出,梁文锋阐述开源底层逻辑。他明确承诺最强模型也会开源,认为闭源无必然好处。首次从财务角度说明:十个月回本对应约6倍利润,开源不影响此利润,但会制约100倍暴利。因此在6倍利润前提下,开源对商业模式无碍。
NVIDIA推出Nemotron3Embed嵌入向量模型系列,专为生产级RAG、智能体检索、代码检索和记忆场景设计。8B版本在RTEB基准测试中排名第一,成为性能最强的开源嵌入模型。系列包含三个开放检查点:精度优先的Nemotron-3-Embed-8B-BF16、轻量化的1B-BF16版,以及针对Blackwell架构优化的1B-NVFP4四比特版本,所有模型均采用双向注意力机制。
Openai
$2.8
输入tokens/百万
$11.2
输出tokens/百万
1k
上下文长度
Google
$0.49
$2.1
Xai
$1.4
$3.5
2k
$7.7
$30.8
200
-
Anthropic
$105
$525
$0.7
$7
$35
$17.5
$21
Alibaba
$4
$16
$1
$10
256
$2
$20
Baidu
128
$6
$24
tencent
混元7B是腾讯开源的中英文双语大语言模型,采用更优的数据配比和训练方式,性能强劲,是目前最强的中文7B Dense模型之一。
zai-org
CodeGeeX4-ALL-9B 是基于 GLM-4-9B 持续训练的多语言代码生成模型,是 CodeGeeX4 模型系列的开源版本。该模型在参数少于100亿的代码生成模型中表现最强,支持代码补全、代码解释器、网络搜索、函数调用、仓库级代码问答等全面功能,在推理速度和模型性能之间达到最佳平衡。