科大讯飞发布星火X2.5大模型,采用混合专家架构,总参数2930亿、推理仅激活300亿,兼顾高效与性能提升。重点强化代码生成和智能体交互,数学计算、语义理解等通用能力增强,并全面支持256K长上下文处理。
科大讯飞发布星火X2.5大模型,采用MoE混合专家架构,参数规模达293B-A30B,在架构设计、核心能力及国产算力适配方面全面升级,重点强化代码编写与智能体(Agent)应用开发能力。
科大讯飞发布星火X2.5大模型,采用MoE架构,参数规模293B-A30B,重点提升代码与智能体能力,并增强数学、理解等通用能力。该模型基于全国产算力完成训练推理,优化国产超长序列训推难题,已上线讯飞开放平台。端侧4B和1.7B模型已先行开源,支持最长100万Token上下文。
科大讯飞子公司词元星火9月1日开源星火X2.5-4B和1.7B两款端侧通用大模型,为端侧首个原生支持100万Token上下文,并开放权重、代码仓库与部署文档。模型采用混合注意力架构,优化智能体、代码、数学、指令遵循等核心能力,实现小模型“读全书”,综合实测能力领先。
Google
$2.1
Input tokens/M
$17.5
Output tokens/M
1k
Context Length
$0.7
$2.8
Alibaba
-
Bytedance
$1.2
$3.6
4
$0.8
$2
128
$8
32
$0.5
Iflytek
8
$8.75
$70
$1.6
$4
Baichuan