谷歌發佈全新多模態模型Gemma4 12B,顛覆傳統架構,取消獨立編碼器組件,實現消費級硬件上的高效本地部署與推理。這一突破顯著降低多模態模型的計算複雜度,提升運行速度,標誌着開源大模型生態進入新階段。
Google發佈全新開源大模型Gemma412B,採用“Unified”無編碼器架構,突破端側全模態AI。該模型無需傳統視覺、音頻外部編碼器,直接輸入文字、圖像、音頻、視頻四種模態數據至同一Transformer主幹網絡處理,消除了外掛“翻譯”模塊帶來的顯存佔用和高延遲問題。
谷歌DeepMind發佈開源大模型Gemma4,雖參數規模保持約300億,但“單位參數智能密度”顯著提升,性能媲美一年半前的頂尖閉源模型。其核心突破在於引入“E2B”(參數卸載)架構,標誌着開源大模型底層架構的重大升級。
Apple Silicon 本地AI生態迎來重要更新:oMLX框架0.3.9.dev2版本發佈,深度集成Gemma4的MTP視覺路徑、DFlash引擎及ParoQuant量化技術,顯著提升圖文多模態處理速度與易用性,進一步鞏固蘋果端側AI的競爭力。
Google
-
輸入tokens/百萬
輸出tokens/百萬
上下文長度
$140
$280
32
$0.14
$0.28
131
$0.7
$1.4
$0.35
Alibaba
$2
$1