阿里巴巴推出 GUI 智能体基座模型 Qwen-UI-Agent,以真实世界为中心,覆盖移动端、电脑端、网页端及深度搜索,旨在突破模拟测试限制,实现复杂真实设备无缝操作。其在 MobileWorld 移动端测试中获 82.1% 高分,领先多个主流模型,综合性能全面超越行业旗舰。
阿里巴巴8月20日发布GUI智能体基座模型Qwen-UI-Agent,覆盖移动端、电脑端、网页端及深度搜索,多项核心基准超越业界旗舰。移动端MobileWorld得82.1%,分别领先GPT-5.6Sol和Claude Opus4.8达12.0和14.6个百分点,展现强劲实力。
智谱发布GLM-5.3,基座模型完全未变,提升全部来自后训练Scaling。通过数十倍规模长程任务环境、更丰富环境类型和超长后训练时间,相同基座智能上界被显著抬高。内部评测编程体感较GLM-5.2提升约50%,成为当前编程能力最强的开源模型,公开基准表现同样亮眼。
美团7月27日否认LongCat团队基础模型负责人裴鹏离职传闻,称消息不实。裴鹏毕业于北大,2023年加入美团,先后任基座模型预训练负责人及LongCat基础模型负责人,全面主导大语言模型、多模态模型与Agent智能体的研发,并牵头万亿参数大模型LongCat-2.0的研发与落地。
智元发布首个通用具身基座大模型GO-1,开创性提出ViLLA架构,推动具身智能发展。
多语言代码大模型基座
Openai
$2.8
输入tokens/百万
$11.2
输出tokens/百万
1k
上下文长度
Google
$0.49
$2.1
Xai
$1.4
$3.5
2k
$7.7
$30.8
200
-
Anthropic
$105
$525
$0.7
$7
$35
$17.5
$21
Alibaba
$4
$16
$1
$10
256
$2
$20
Baidu
128
$6
$24
metavoiceio
MetaVoice-1B是一个12亿参数的文本转语音(TTS)基座模型,经过10万小时语音数据训练,专注于生成情感化的英语语音,并支持声音克隆和长文本合成。
Tele-AI
TeleChat是由中电信人工智能科技有限公司研发训练的大语言模型,7B模型基座采用1.5万亿Tokens中英文高质量语料进行训练,12B模型基座采用3万亿Tokens中英文高质量语料进行训练。
NumbersStation
NSQL-6B是一个专为SQL生成任务设计的自回归大模型基座,基于Salesforce的CodeGen-Multi 6B模型进行预训练和微调。
MCP STL 3D浮雕生成器是一个将2D图像转换为3D浮雕模型的工具,支持控制模型尺寸、添加基座和深度反转等功能,适合3D打印和渲染。