Google發佈全新開源大模型Gemma412B,採用“Unified”無編碼器架構,突破端側全模態AI。該模型無需傳統視覺、音頻外部編碼器,直接輸入文字、圖像、音頻、視頻四種模態數據至同一Transformer主幹網絡處理,消除了外掛“翻譯”模塊帶來的顯存佔用和高延遲問題。