新一代具身推理模型Gemini Robotics ER2发布,专为硬件打造,显著提升物理环境理解与多步骤任务规划能力,并首次攻克多机器人协同作业难题,加速人形机器人落地迭代。
Google DeepMind发布新一代音乐生成模型Lyria3.5,在音乐性、歌词与人声表现力及创作控制上大幅提升,可构建更复杂自然的旋律织体,推动AI音乐向专业应用迈进。
谷歌DeepMind已悄然解散曾获诺贝尔化学奖的AlphaFold团队。该系统的核心人物哈萨比斯与江珀刚在2024年凭此获奖,但过去一年中,多数原始论文作者已被重新分配至其他项目,这支明星团队正被悄然拆解。
谷歌DeepMind因员工士气低迷推迟发布Gemini 3.5 Pro,模型已落后原计划数月。近期推出的小模型市场反应褒贬不一,遭Meta AI负责人汪滔公开嘲讽。团队正经历严重人才流失,军方合约被指加剧离心,Gemini联合负责人诺姆·沙泽尔亦被曝离职。
Veo 4 是 Google DeepMind 的 AI 视频生成与图像编辑平台。
Google DeepMind旗舰多模态AI,1M上下文,具备博士级推理与高级编码能力
Nano Banana 2 是由 Google DeepMind 开发的专业 AI 图像编辑器。
Google DeepMind推出的最先进的AI天气预报技术。
Google
-
输入tokens/百万
输出tokens/百万
上下文长度
$0.14
$0.28
131
$1
$17.5
$70
2.1k
brittlewis12
Gemma 3 4B IT GGUF 是 Google DeepMind 推出的轻量级开源语言模型,基于与 Gemini 模型相同的研究和技术构建。该模型具有 128K 的大上下文窗口,支持超过 140 种语言,采用 GGUF 格式便于在各种设备上部署运行。
Gemma 3 1B IT GGUF 是 Google DeepMind 开发的轻量级开源语言模型的 GGUF 格式版本。该模型基于 Gemma 3 1B IT(指令微调)模型转换而来,具有 128K 的大上下文窗口,支持超过 140 种语言,适合在资源有限的环境中部署。
Crystalcareai
GemMoE 是基于 Deepmind 的 Gemma 架构的专家混合(MoE)模型,融合了 8 个单独微调的 Gemma 模型,每个令牌配备 2 个专家,功能强大且易于训练和推理。
HuggingFaceM4
IDEFICS是Deepmind开发的闭源视觉语言模型Flamingo的开源复现版本,支持多模态输入(图像+文本)并生成文本输出。
IDEFICS 是 Deepmind 开发的闭源视觉语言模型 Flamingo 的开源复现版本,是一个多模态模型,可以接受任意序列的图像和文本输入,并生成文本输出。
IDEFICS是一个开源的多模态模型,能够处理图像和文本输入并生成文本输出,是Deepmind Flamingo模型的开源复现版本。
IDEFICS-9B是一个90亿参数的多模态模型,能够处理图像和文本输入并生成文本输出,是Deepmind Flamingo模型的开源复现版本。
deepmind
基于BERT的掩码语言建模任务预训练,支持处理UTF-8字节输入的多模态Transformer模型
基于ImageNet预训练的通用视觉感知器模型,采用卷积预处理和Transformer架构,支持图像分类任务
基于ImageNet预训练的通用视觉感知器模型,采用学习型位置嵌入处理图像输入
oandreae
该模型是基于deepmind/language-perceiver在financial_phrasebank数据集上微调的金融文本情感分类模型。
Perceiver IO是一种通用Transformer架构,可处理多种模态数据,本模型专为图像分类任务设计,在ImageNet数据集上预训练。