据人民邮电报7月21日消息,中国电信率先将大模型应用于5G无线网络规划,现网试点后,规划效率提升50%,方案准确率超75%,可自动生成设计方案并精准预测效果,改变了传统依赖人工勘察和专家比选的低效模式。
前OpenAI CTO Mira Murati创立的Thinking Machines Lab于2026年7月15日发布首个开源模型Inkling。该模型采用混合专家架构,总参数量达9750亿,单次任务仅激活部分参数,实现高效定制。此举意在挑战巨头主导的闭源AI模式,提供可高度定制的开放权重方案。
商汤发布并开源“日日新SenseNova-Vision”视觉大模型,核心是将视觉能力原生融入通用基础模型,打破传统将检测、分割等专家模型打包的割裂模式。该模型以单模型在多项评测中实现了四大领域的性能碾压,标志着视觉任务向统一原生架构的关键升级。
DeepSeek于5月9日大规模开放“识图模式”内测,标志其进入图文多模态交互时代。此前4月底小范围灰度测试后,多数账号现可通过对话界面独立入口使用该功能。系统虽仍标注内测,但功能与“快速模式”、“专家模式”并列,预示多模态理解成核心方向。
Alibaba
$4
Input tokens/M
$16
Output tokens/M
1k
Context Length
Baidu
-
128
$6
$24
256
Deepseek
$12
32
$0.75
Openai
$8.75
$70
400
$2
64
$0.63
$3.15
131
$1
Chatglm
$8
$0.3
DavidAU
基于OpenAI的gpt-oss-120b模型优化的大型语言模型,使用NEO数据集进行性能提升,支持多场景应用,可在CPU、GPU或部分卸载模式下运行,具有128k上下文长度和最多128个专家的混合专家架构。
cpatonn
Qwen3-30B-A3B-Instruct-2507是阿里云推出的305亿参数混合专家模型,采用非思考模式,在指令遵循、逻辑推理、文本理解、数学科学、编码和工具使用等方面表现优异,支持262K长上下文和多语言处理。
QuixiAI
Qwen3-30B-A3B-AWQ是基于Qwen3-30B-A3B模型的AWQ量化版本,是通义系列最新一代大语言模型。该模型采用专家混合(MoE)架构,支持思考模式和非思考模式的双模式切换,在推理、指令遵循、智能体能力和多语言支持方面表现优异。
nbeerbower
HeroBophades-3x7B是一个基于mergekit构建的实验性专家混合(LLM)模型,设计为在12GB显存的GPU上以4位模式运行。
Pearl MCP Server是一个标准化的AI与专家服务接口实现,支持通过MCP协议与各类客户端交互,提供AI自动应答、AI辅助专家和直接专家咨询三种服务模式。