中国电信9月17日发布星辰大模型Xing4.0-29B-A4B,总参数29B、激活4B,原生支持256K上下文并可扩展至512K。它是国内首个从训练芯片到推理部署全栈国产的百亿参数大模型,主打复杂工程任务。采用昇腾芯片训练、国产框架适配、自研架构、生态开源,实现底层算力到工具链的国产闭环。
小红书发布开源大模型dots3-note preview,总参数量280B、激活16B,支持文本、视觉、语音全模态,推理、Agent及多模态表现接近更大模型。同日华为昇腾Atlas 800A3与900A3 SuperPoD完成高效适配,并借助vLLM Ascend实现部署。
华为开源盘古大模型openPangu-2.0-Pro,基于昇腾NPU训练,采用混合专家架构,总参数5050亿,激活参数180亿,支持512K上下文。同步开放权重、推理代码与技术报告,推动昇腾AI生态,提供原生训练推理实践。
智谱斥资数亿元收购AI Infra公司中科加禾,强化国产算力适配与推理优化。中科加禾源自中科院计算所,专注编译技术,团队曾参与龙芯、华为昇腾等国产芯片编译器开发,具备从虚拟指令集到优化部署的全链路能力,补足模型底层工程短板。
Tencent
-
Input tokens/M
Output tokens/M
Context Length
Stepfun
$100
imone
盘古α是由鹏城实验室联合技术团队研发的26亿参数中文预训练语言模型,基于2048颗昇腾处理器训练完成,具备强大的文本生成能力。