科大訊飛發佈星火X2.5大模型,採用混合專家架構,總參數2930億、推理僅激活300億,兼顧高效與性能提升。重點強化代碼生成和智能體交互,數學計算、語義理解等通用能力增強,並全面支持256K長上下文處理。
科大訊飛發佈星火X2.5大模型,採用MoE混合專家架構,參數規模達293B-A30B,在架構設計、核心能力及國產算力適配方面全面升級,重點強化代碼編寫與智能體(Agent)應用開發能力。
科大訊飛發佈星火X2.5大模型,採用MoE架構,參數規模293B-A30B,重點提升代碼與智能體能力,並增強數學、理解等通用能力。該模型基於全國產算力完成訓練推理,優化國產超長序列訓推難題,已上線訊飛開放平臺。端側4B和1.7B模型已先行開源,支持最長100萬Token上下文。
科大訊飛子公司詞元星火9月1日開源星火X2.5-4B和1.7B兩款端側通用大模型,爲端側首個原生支持100萬Token上下文,並開放權重、代碼倉庫與部署文檔。模型採用混合注意力架構,優化智能體、代碼、數學、指令遵循等核心能力,實現小模型“讀全書”,綜合實測能力領先。
Google
$2.1
輸入tokens/百萬
$17.5
輸出tokens/百萬
1k
上下文長度
$0.7
$2.8
Alibaba
-
Bytedance
$1.2
$3.6
4
$0.8
$2
128
Iflytek
8
$8
32
$0.5
$8.75
$70
$1.6
$4
Baichuan