9月22日雲棲大會杭州開幕,阿里公佈大模型進展:Qwen4已投入訓練,後續參數規模計劃擴至5萬億至10萬億;遞歸自我改進進入訓練、推理及芯片協同;多模態矩陣升級,11月發佈新一代視頻生成模型。劉大一恆稱Scaling是邁向ASI的重要路徑。
阿里通義千問團隊近日開源全新多模態MoE模型Qwen3.8-Flash-Next,作爲Qwen4架構早期預覽版。該模型採用高度稀疏的混合專家設計,總參數1250億,另搭配510億參數N-gram嵌入表和40億參數多token預測模塊,以極低計算開銷實現越級性能表現。
阿里千問發佈多模態MoE模型Qwen3.8-Flash,並開源下一代架構Qwen3.8-Flash-Next(Qwen4雛形)。模型總參數125B,搭載51B N-gram Embedding,每token僅激活6B;原生支持26萬token,可擴展至100萬。訓練成本爲前代1/9,API定價輸入每百萬Tokens 1元、輸出3元。
Alibaba
$1
輸入tokens/百萬
$10
輸出tokens/百萬
256
上下文長度
-
$6
$24
$2
$20
$4
$16
1k
$8
$240
52
$15.8
$12.7
64
$3.9
$15.2
$0.8
128
$54
$163
32
$1.6
$0.75