网友借助DeepSeek V4.1 Flash模型与Hermes Agent工具,对《生化危机7》纹理进行AI调优,使一加12R(骁龙8Gen2)帧率从约20FPS升至30FPS,提升50%。AI通过USB连接Mac监控性能,指出I/O和内存带宽为瓶颈,并建议压缩纹理分辨率。
9月16日,2026 vivo开发者大会宣布蓝心大模型全面升级,打造以个人为中心的智能体矩阵,发布Blue LM-RealTime、Nano、Flash、Pro四款核心模型,覆盖语音理解、端侧感知记忆与云侧任务执行。语音模型采用端到端架构,抗嘈杂口音,端侧模型可沉淀个人记忆。
DeepSeek Harness(DSH)8月随V4 Pro发布,初期仅支持Web界面,数天获超10万GitHub星。因官方桌面端缺失,社区自发推出多款第三方客户端。最新官方主分支已新增桌面端目录,将支持macOS苹果芯片、Intel及Windows x64,暂不支持Linux,正式版上线时间待公布。
DeepSeek本周发布V4.1 Flash,架构变化巨大但未升大版本号。V4.1 Pro已确定,具体升级未公布,性能上限或较高,但鉴于前代Pro不及预期,外界期待不宜过高。另有Code 2.0被曝即将发布,主打电脑控制,后续还有更多大模型。
Omni 1.1 Flash可将文本或图像转化为带原生音频、最高4K输出的AI视频。
构建自定义AI时尚模特,生成逼真产品图片和视频,拍摄风格一致
谷歌原生多模态AI视频生成与编辑工具,支持文本、图像和音频一键同步创作。
一款免费的 AI 视频生成器,支持将文本、图片或视频剪辑转化为电影级 4K 视频。
Google
$0.49
输入tokens/百万
$2.1
输出tokens/百万
1k
上下文长度
$0.7
$2.8
$17.5
Alibaba
$8
$240
52
$3.9
$15.2
64
-
Bytedance
$0.8
$2
256
$0.15
$1.5
$1
$4
$15
Chatglm
128
$0.2
$1.05
$4.2
TeichAI
本模型是基于Qwen3-4B架构的知识蒸馏模型,通过约5440万个由Gemini 2.5 Flash生成的标记进行训练,旨在整合Gemini-2.5 Flash的行为、推理过程和知识到单一数据集中。
Mungert
基于RWKV-7架构的轻量级语言模型,采用flash-linear attention格式,具备多语言支持和深度思考能力,适用于文本生成任务。
基于RWKV-7架构的多语言文本生成模型,拥有29亿参数,支持英语、中文、日语、韩语、法语、阿拉伯语、西班牙语和葡萄牙语等多种语言,采用flash-linear attention格式,适用于高质量的文本生成任务。
FlashVL
FlashVL是一种优化视觉语言模型(VLMs)以用于实时应用的新方法,旨在实现超低延迟和高吞吐量,同时不牺牲准确性。
基于flash-linear attention格式的RWKV-7模型,支持多语言文本生成任务。
RWKV
采用闪存线性注意力(flash-linear attention)格式的RWKV-7模型,支持英语文本生成任务。
fla-hub
这是一个采用flash-linear注意力格式的RWKV-7模型,参数量为0.45B,支持多种语言的文本生成任务,具有65,536的大词汇量。
nvidia
NVIDIA NeMo Canary Flash 是一个多语言多任务语音模型,支持英语、德语、法语和西班牙语的自动语音识别和翻译任务。
基于Flash线性注意力机制的RWKV-7 g1模型,支持多语言处理并具备深度思考能力
NVIDIA NeMo Canary Flash 是一个多语言多任务模型家族,在多个语音基准测试中实现了最先进的性能。支持四种语言的自动语音识别和翻译任务。
sdadas
基于sdadas/polish-roberta-large-v2改进的波兰语重排序模型,采用RankNet损失函数训练,支持Flash Attention 2加速
jasperai
闪电扩散(Flash Diffusion)是Jasper Research团队提出的一种扩散蒸馏方法,能够在4步内生成1024x1024分辨率的图像。
amirMohammadi
Dorna-Llama3-8B-Instruct的4位量化版本,针对波斯语优化,集成Flash Attention 2技术提升推理效率
闪电扩散是一种扩散蒸馏方法,能够在4步内生成高质量图像,是SDXL的1.08亿参数LoRA蒸馏版本。
基于PixArt-α的低秩适配蒸馏版本,仅需4步即可生成1024x1024图像
FredrikBL
test-dare 是一个基于 Mistral-7B 的合并模型,通过 DARE 方法合并了多个 Mistral-7B 变体,旨在结合各模型的优势。
timpal0l
基于Mistral-7B-v0.1的预训练延续模型,使用瑞典论坛Flashback的40GB文本数据进行微调,支持多语言生成。
一个基于Gemini Flash 2 AI模型的数据分析与研究MCP服务器,提供数据解析、智能分析、报告生成和邮件自动发送功能。
基于Google Gemini 2.5 Flash API的MCP图像生成与编辑服务器,支持文本生成图像、图像编辑、迭代创作和风格迁移功能
一个简单的MCP服务器,用于与Pure Storage存储阵列交互,实时获取FlashBlade阵列信息
一个基于Gemini Flash 2 AI模型的数据分析与研究MCP服务器,提供数据解析、统计分析、研究报告生成和邮件自动发送功能。
一个基于TypeScript的MCP服务器实现,通过直接调用Google Gemini API集成Gemini模型,支持最新Gemini 2.0 Flash模型并保持对话上下文。
Gemini Nanobanana MCP 是一个让用户通过文本描述生成AI图像的Claude插件,集成了Google Gemini 2.5 Flash图像生成功能,支持多种图像编辑和创作方式。
一个基于Gemini Flash 2.0的命令行代码摘要工具,支持MCP服务器集成
一个基于Google Gemini模型的AI图像生成MCP服务器,支持智能模型选择(Flash快速生成和Pro高质量4K生成)、多种宽高比控制、文件管理和模板功能,提供生产级图像生成能力。
为Roo Code提供Gemini 2.0 Flash图像生成的MCP服务
一个基于Docker的Python闪卡管理服务器,使用OpenAI嵌入和SQLite实现语义搜索和存储功能。
Flashduty MCP Server是一个基于Model Context Protocol的服务器,提供与Flashduty API的无缝集成,支持事件管理和自动化功能。
基于Google Gemini 2.5 Flash Image API的MCP服务器,提供文本生成图像、图像编辑、多图合成和风格转换等功能,支持多种MCP客户端使用。
Agent X是一个基于Google Gemini Flash和Twitter API的自主AI代理,能够智能生成并发布推文。
一个基于Gemini Flash 2 AI模型的数据分析与研究MCP服务器,提供数据解析、AI分析、可视化报告和邮件自动发送功能
LLM Gateway是一个基于MCP协议的服务器,支持高级AI代理(如Claude 3.7)将任务智能委托给成本更低的LLM模型(如Gemini Flash),实现成本优化和性能平衡。
概述:MCP(模型上下文协议)是一个通过标准化协议实现AI自动化的框架,包含主机、客户端、服务器、本地数据源和远程服务等关键组件。其核心在于服务器,它为客户端提供上下文、工具和提示。MCP使AI代理能够自动化执行任务,如代码生成、调试以及与GitHub仓库等外部服务交互。
一个基于Gemini Flash 1.5 API的MCP服务器实现,通过中央路由器协调多个模块化AI服务(聊天、搜索、RAG、深度推理等),实现智能化的请求分发和响应整合。
该项目是一个基于Gemini Flash 1.5 API的MCP服务器实现,通过中央路由器协调多个模块化AI服务(如聊天、搜索、RAG、深度推理等),实现智能化的请求分发和响应处理。