谷歌发布全新多模态模型Gemma4 12B,颠覆传统架构,取消独立编码器组件,实现消费级硬件上的高效本地部署与推理。这一突破显著降低多模态模型的计算复杂度,提升运行速度,标志着开源大模型生态进入新阶段。
Google发布全新开源大模型Gemma412B,采用“Unified”无编码器架构,突破端侧全模态AI。该模型无需传统视觉、音频外部编码器,直接输入文字、图像、音频、视频四种模态数据至同一Transformer主干网络处理,消除了外挂“翻译”模块带来的显存占用和高延迟问题。
谷歌DeepMind发布开源大模型Gemma4,虽参数规模保持约300亿,但“单位参数智能密度”显著提升,性能媲美一年半前的顶尖闭源模型。其核心突破在于引入“E2B”(参数卸载)架构,标志着开源大模型底层架构的重大升级。
Apple Silicon 本地AI生态迎来重要更新:oMLX框架0.3.9.dev2版本发布,深度集成Gemma4的MTP视觉路径、DFlash引擎及ParoQuant量化技术,显著提升图文多模态处理速度与易用性,进一步巩固苹果端侧AI的竞争力。
Google
-
输入tokens/百万
输出tokens/百万
上下文长度
$140
$280
32
$0.14
$0.28
131
$0.35
$0.7
$1.4
Alibaba
$2
$1