AIBase
首頁
AI 資訊
AI 產品庫
GEO 平台
MCP 服务
模型算力廣場
VIP會員
TW

AI資訊

查看更多

通義千問發佈Qwen3.8-Flash-Next,提前劇透Qwen4架構

阿里通義千問團隊近日開源全新多模態MoE模型Qwen3.8-Flash-Next,作爲Qwen4架構早期預覽版。該模型採用高度稀疏的混合專家設計,總參數1250億,另搭配510億參數N-gram嵌入表和40億參數多token預測模塊,以極低計算開銷實現越級性能表現。

14.9k 6 小時前
通義千問發佈Qwen3.8-Flash-Next,提前劇透Qwen4架構

​DeepSeek 推出 Engram 模塊:爲稀疏大模型植入“條件記憶軸”,效率大幅提升

DeepSeek團隊推出Engram模塊,爲稀疏大語言模型引入“條件記憶軸”,旨在解決傳統Transformer處理重複知識時計算資源浪費的問題。該模塊作爲混合專家模型的補充,將N-gram嵌入技術融入模型,提升處理重複模式的效率。

18.3k 5 天前
​DeepSeek 推出 Engram 模塊:爲稀疏大模型植入“條件記憶軸”,效率大幅提升

模型

查看更多

Qwen-Image

Alibaba

Qwen-Image

$2

輸入tokens/百萬

-

輸出tokens/百萬

-

上下文長度

Hunyuan-Embedding

Tencent

Hunyuan-Embedding

$0.7

輸入tokens/百萬

$0.7

輸出tokens/百萬

-

上下文長度

AIBase
智啟未來,您的人工智能解決方案智庫
English简体中文繁體中文にほんご
友情链接:
AI Newsletters AI ToolsMCP ServersAI NewsAI MarketingLLM LeaderboardAI Ranking
© 2026AIBase
商務合作網站地圖