7月28日,月之暗面发布Kimi K3模型权重及技术报告,同步开源MoonEP、FlashKDA和AgentEnv三项关键基础设施技术。Kimi K3为目前最强模型,采用MoE架构,总参数达2.8万亿。这三项技术为大规模训练的效率、稳定性及智能体任务执行,提供了核心底层支撑。
DeepSeek投资者交流会内部谈话流出,梁文锋阐述开源底层逻辑。他明确承诺最强模型也会开源,认为闭源无必然好处。首次从财务角度说明:十个月回本对应约6倍利润,开源不影响此利润,但会制约100倍暴利。因此在6倍利润前提下,开源对商业模式无碍。
NVIDIA推出Nemotron3Embed嵌入向量模型系列,专为生产级RAG、智能体检索、代码检索和记忆场景设计。8B版本在RTEB基准测试中排名第一,成为性能最强的开源嵌入模型。系列包含三个开放检查点:精度优先的Nemotron-3-Embed-8B-BF16、轻量化的1B-BF16版,以及针对Blackwell架构优化的1B-NVFP4四比特版本,所有模型均采用双向注意力机制。
前OpenAI CTO穆拉蒂创立的思维机器实验室发布首款从零训练多模态模型Inkling,号称美国最强开源。采用MoE(975B总参/41B激活),上下文100万token,预训练45万亿token覆盖图文音视频,已开源权重。团队豪华,但推理编程不及中国开源劲旅。
Openai
$2.8
Input tokens/M
$11.2
Output tokens/M
1k
Context Length
Google
$0.49
$2.1
Xai
$1.4
$3.5
2k
$7.7
$30.8
200
-
Anthropic
$105
$525
$0.7
$7
$35
$17.5
$21
Alibaba
$4
$16
$1
$10
256
$2
$20
Baidu
128
$6
$24
tencent
混元7B是腾讯开源的中英文双语大语言模型,采用更优的数据配比和训练方式,性能强劲,是目前最强的中文7B Dense模型之一。
zai-org
CodeGeeX4-ALL-9B 是基于 GLM-4-9B 持续训练的多语言代码生成模型,是 CodeGeeX4 模型系列的开源版本。该模型在参数少于100亿的代码生成模型中表现最强,支持代码补全、代码解释器、网络搜索、函数调用、仓库级代码问答等全面功能,在推理速度和模型性能之间达到最佳平衡。