8月13日,谷歌发布Gemini 3.7 Flash,距前代仅三周,定位为最强代码编写与AI Agent模型,归功算法突破。其FrontierCode得分升至43.6%,DeepSWE升至65.3%,在软件工程、逻辑、Web开发、文档理解及业务流程自动化上表现突出,综合性能显著提升。
8月13日,谷歌发布升级版Gemini 3.7 Flash模型。其在代码调试等编程任务中表现更优,可一次性生成接近生产标准的高质量代码,并支持以更简洁提示词完成开发,提升效率与体验,同时降低词元成本。
谷歌DeepMind推出多语言手语转文本模型SL2T,并首次搭载于Pixel11手机,让手语AI进入消费电子产品。该模型接入Gboard和Live Transcribe,用户通过前置摄像头打手语,即可编辑消息、网页检索及与Gemini对话,替代键盘输入。SL2T基于50多种手语、10万小时素材训练,约四分之一来自美国手语数据集,跨语种联合训练提升识别效果。
谷歌正式发布Pixel 11系列,外观和核心硬件改动有限,主打软件体验与Gemini人工智能深度融合。Gemini具备更强的自主代理执行能力,可在后台高效完成日常繁杂任务,进一步提升智能化使用体验。
基于谷歌Gemini 2.5 Flash模型的免费AI图像编辑与生成工具
Gemini 2.5 是谷歌最智能的 AI 模型,具备推理能力。
Gemini 2.0 是谷歌推出的最新一代生成式 AI 模型,包含 Flash、Flash-Lite 和 Pro 版本。
创新折叠屏手机,搭载先进的谷歌AI助理Gemini。
Openai
$2.8
输入tokens/百万
$11.2
输出tokens/百万
1k
上下文长度
Google
$0.49
$2.1
$7.7
$30.8
200
$0.7
$17.5
$0.4
-
128
$1.75
$14
400
$140
$280
32
$8.75
$70
$56
MuXodious
Gemma 3n E4B IT 是谷歌推出的轻量级多模态开放模型,基于与Gemini模型相同的研究构建。该模型支持文本、音频和视觉输入,适用于多种任务,采用MatFormer架构实现高效参数利用。
prithivMLmods
Gemma 3 270M是谷歌推出的轻量级多模态模型,基于与Gemini系列相同的研究技术,支持文本和图像输入,具有32K上下文窗口,在问答、总结、图像理解和代码生成等任务上提供高质量输出。
unsloth
Gemma 3是谷歌推出的轻量级、最先进的开放模型家族,基于与Gemini模型相同的研究和技术构建。具有多模态处理能力,支持文本和图像输入,并生成文本输出,适用于各种文本生成和图像理解任务。
Gemma 3是谷歌推出的轻量级、最先进的开源多模态模型家族,基于与Gemini模型相同的研究和技术构建。该270M版本是经过指令调优的模型,采用量化感知训练(QAT),能够在显著降低内存需求的同时保持与bfloat16相近的质量。
Gemma 3是谷歌推出的轻量级开源多模态模型系列,基于与Gemini相同技术构建。270M版本是其中最小规模模型,支持文本和图像输入,具备128K上下文窗口,适用于资源受限环境部署。
Gemma 3是谷歌推出的轻量级开源多模态模型家族,基于与Gemini相同的研究技术构建。270M版本是其中最小的指令微调模型,支持140多种语言,具有32K上下文长度,适用于资源受限环境下的文本生成任务。
Gemma 3是谷歌推出的轻量级、最先进的开源多模态模型家族,基于与Gemini模型相同的研究和技术构建。270M版本是其中最小的模型,能够处理文本和图像输入并生成文本输出,适用于多种文本生成和图像理解任务。
Gemma 3n是谷歌推出的轻量级、最先进的多模态开放模型,基于Gemini技术构建。专为低资源设备设计,支持文本、图像、视频和音频输入,生成文本输出。采用选择性参数激活技术,在4B参数规模下高效运行。
iqbalamo93
Gemma 3是谷歌推出的轻量级多模态模型,基于与Gemini相同的技术构建。它支持文本和图像输入,输出文本,适用于文本生成和图像理解等多种任务,且模型尺寸多样,能在资源有限的环境中部署。
Gemma 3是谷歌基于Gemini技术构建的轻量级开放模型系列,12B版本采用量化感知训练(QAT)技术,支持多模态输入和128K上下文窗口。
Gemma 3是谷歌推出的轻量级、最先进的开放模型家族,基于与Gemini模型相同的研究和技术构建。该27B版本采用量化感知训练(QAT),能够在显著降低内存需求的同时保持与bfloat16相近的质量,具备多模态处理能力和128K大上下文窗口。
Gemma 3是谷歌推出的轻量级前沿开放模型系列,基于Gemini模型技术构建,支持多模态输入和文本输出。
Gemma 3是谷歌推出的轻量级先进开放模型系列,基于创建Gemini模型的相同研究和技术构建。该模型是多模态的,能够处理文本和图像输入并生成文本输出。
Gemma 3是谷歌推出的轻量级开源多模态模型系列,基于与Gemini模型相同的研究构建。本版本为4B参数的指令微调模型,采用量化感知训练(QAT),支持文本和图像输入并生成文本输出,适用于多种文本生成和图像理解任务。
Gemma 3是谷歌推出的轻量级多模态模型,基于与Gemini相同的技术构建,支持文本和图像输入,输出文本内容。具有128K大上下文窗口,支持超140种语言。
EpistemeAI
Gemma 3是谷歌推出的轻量级开源多模态模型,基于与Gemini相同技术构建,支持文本和图像输入并生成文本输出。
Mungert
Gemma是谷歌推出的轻量级前沿开放模型系列,基于Gemini技术构建。12B版本是多模态模型,支持文本和图像输入,具有128K大上下文窗口和140多种语言支持。
Gemma是谷歌推出的轻量级尖端开放模型家族,基于与Gemini模型相同的研究和技术构建。支持文本和图像输入并生成文本输出。
gaunernst
Gemma 3是谷歌推出的轻量级开源多模态模型,基于Gemini技术构建,支持文本和图像输入,生成文本输出。
vinimuchulski
Gemma 3是谷歌基于Gemini技术构建的轻量级开放模型,支持文本和图像输入,生成文本输出。12B版本经过指令调优,适用于多种生成和理解任务。
一个集成了LangChain、自定义MCP服务器和谷歌Gemini AI模型的聊天平台,提供增强的对话功能。
GemForge是将谷歌Gemini AI与MCP生态系统连接的企业级工具,提供实时网络访问、高级推理、代码分析和多文件处理等功能,支持60多种文件格式,具备智能模型选择和强大的错误处理机制。