全球AI領域正經歷“AI母語”技術變革。針對當前大模型“語言中心、外掛視覺或語音”的拼湊架構,團隊發佈並開源了原生多模態大模型LongCat-Next及離散分詞器,旨在打破模態壁壘,讓AI像處理文字一樣理解物理世界。核心是通過重構底層架構實現突破。
美團發佈原生多模態大模型LongCat-Next,突破傳統“語言基座+插件”架構,通過DiNA技術將圖像、語音與文本統一轉化爲同源離散Token,實現AI原生“看”與“聽”物理世界,完成多模態建模深度統一。