網友藉助DeepSeek V4.1 Flash模型與Hermes Agent工具,對《生化危機7》紋理進行AI調優,使一加12R(驍龍8Gen2)幀率從約20FPS升至30FPS,提升50%。AI通過USB連接Mac監控性能,指出I/O和內存帶寬爲瓶頸,並建議壓縮紋理分辨率。
9月16日,2026 vivo開發者大會宣佈藍心大模型全面升級,打造以個人爲中心的智能體矩陣,發佈Blue LM-RealTime、Nano、Flash、Pro四款核心模型,覆蓋語音理解、端側感知記憶與雲側任務執行。語音模型採用端到端架構,抗嘈雜口音,端側模型可沉澱個人記憶。
DeepSeek Harness(DSH)8月隨V4 Pro發佈,初期僅支持Web界面,數天獲超10萬GitHub星。因官方桌面端缺失,社區自發推出多款第三方客戶端。最新官方主分支已新增桌面端目錄,將支持macOS蘋果芯片、Intel及Windows x64,暫不支持Linux,正式版上線時間待公佈。
DeepSeek本週發佈V4.1 Flash,架構變化巨大但未升大版本號。V4.1 Pro已確定,具體升級未公佈,性能上限或較高,但鑑於前代Pro不及預期,外界期待不宜過高。另有Code 2.0被曝即將發佈,主打電腦控制,後續還有更多大模型。
Omni 1.1 Flash可將文本或圖像轉化為帶原生音頻、最高4K輸出的AI視頻。
構建自定義AI時尚模特,生成逼真產品圖片和視頻,拍攝風格一致
谷歌原生多模態AI視頻生成與編輯工具,支持文本、圖像和音頻一鍵同步創作。
一款免費的 AI 視頻生成器,支持將文本、圖片或視頻剪輯轉化為電影級 4K 視頻。
Google
$0.49
輸入tokens/百萬
$2.1
輸出tokens/百萬
1k
上下文長度
$0.7
$2.8
$17.5
Alibaba
$8
$240
52
$3.9
$15.2
64
-
Bytedance
$0.8
$2
256
$0.15
$1.5
$1
$4
$15
Chatglm
128
$0.2
$1.05
$4.2
TeichAI
本模型是基於Qwen3-4B架構的知識蒸餾模型,通過約5440萬個由Gemini 2.5 Flash生成的標記進行訓練,旨在整合Gemini-2.5 Flash的行為、推理過程和知識到單一數據集中。
Mungert
基於RWKV-7架構的輕量級語言模型,採用flash-linear attention格式,具備多語言支持和深度思考能力,適用於文本生成任務。
基於RWKV-7架構的多語言文本生成模型,擁有29億參數,支持英語、中文、日語、韓語、法語、阿拉伯語、西班牙語和葡萄牙語等多種語言,採用flash-linear attention格式,適用於高質量的文本生成任務。
FlashVL
FlashVL是一種優化視覺語言模型(VLMs)以用於即時應用的新方法,旨在實現超低延遲和高吞吐量,同時不犧牲準確性。
基於flash-linear attention格式的RWKV-7模型,支持多語言文本生成任務。
RWKV
採用閃存線性注意力(flash-linear attention)格式的RWKV-7模型,支持英語文本生成任務。
fla-hub
這是一個採用flash-linear注意力格式的RWKV-7模型,參數量為0.45B,支持多種語言的文本生成任務,具有65,536的大詞彙量。
nvidia
NVIDIA NeMo Canary Flash 是一個多語言多任務語音模型,支持英語、德語、法語和西班牙語的自動語音識別和翻譯任務。
基於Flash線性注意力機制的RWKV-7 g1模型,支持多語言處理並具備深度思考能力
NVIDIA NeMo Canary Flash 是一個多語言多任務模型家族,在多個語音基準測試中實現了最先進的性能。支持四種語言的自動語音識別和翻譯任務。
sdadas
基於sdadas/polish-roberta-large-v2改進的波蘭語重排序模型,採用RankNet損失函數訓練,支持Flash Attention 2加速
jasperai
閃電擴散(Flash Diffusion)是Jasper Research團隊提出的一種擴散蒸餾方法,能夠在4步內生成1024x1024分辨率的圖像。
amirMohammadi
Dorna-Llama3-8B-Instruct的4位量化版本,針對波斯語優化,集成Flash Attention 2技術提升推理效率
閃電擴散是一種擴散蒸餾方法,能夠在4步內生成高質量圖像,是SDXL的1.08億參數LoRA蒸餾版本。
基於PixArt-α的低秩適配蒸餾版本,僅需4步即可生成1024x1024圖像
FredrikBL
test-dare 是一個基於 Mistral-7B 的合併模型,通過 DARE 方法合併了多個 Mistral-7B 變體,旨在結合各模型的優勢。
timpal0l
基於Mistral-7B-v0.1的預訓練延續模型,使用瑞典論壇Flashback的40GB文本數據進行微調,支持多語言生成。
一個基於Gemini Flash 2 AI模型的數據分析與研究MCP服務器,提供數據解析、智能分析、報告生成和郵件自動發送功能。
一個簡單的MCP服務器,用於與Pure Storage存儲陣列交互,即時獲取FlashBlade陣列信息
一個基於TypeScript的MCP服務器實現,通過直接調用Google Gemini API集成Gemini模型,支持最新Gemini 2.0 Flash模型並保持對話上下文。
一個基於Google Gemini模型的AI圖像生成MCP服務器,支持智能模型選擇(Flash快速生成和Pro高質量4K生成)、多種寬高比控制、文件管理和模板功能,提供生產級圖像生成能力。
基於Google Gemini 2.5 Flash API的MCP圖像生成與編輯服務器,支持文本生成圖像、圖像編輯、迭代創作和風格遷移功能
一個基於Gemini Flash 2 AI模型的數據分析與研究MCP服務器,提供數據解析、統計分析、研究報告生成和郵件自動發送功能。
一個基於Gemini Flash 2.0的命令行代碼摘要工具,支持MCP服務器集成
Gemini Nanobanana MCP 是一個讓用戶通過文本描述生成AI圖像的Claude插件,集成了Google Gemini 2.5 Flash圖像生成功能,支持多種圖像編輯和創作方式。
為Roo Code提供Gemini 2.0 Flash圖像生成的MCP服務
一個基於Gemini Flash 2 AI模型的數據分析與研究MCP服務器,提供數據解析、AI分析、可視化報告和郵件自動發送功能
基於Google Gemini 2.5 Flash Image API的MCP服務器,提供文本生成圖像、圖像編輯、多圖合成和風格轉換等功能,支持多種MCP客戶端使用。
該項目是一個基於Gemini Flash 1.5 API的MCP服務器實現,通過中央路由器協調多個模塊化AI服務(如聊天、搜索、RAG、深度推理等),實現智能化的請求分發和響應處理。
一個基於Gemini Flash 1.5 API的MCP服務器實現,通過中央路由器協調多個模塊化AI服務(聊天、搜索、RAG、深度推理等),實現智能化的請求分發和響應整合。
一個基於Docker的Python閃卡管理服務器,使用OpenAI嵌入和SQLite實現語義搜索和存儲功能。
概述:MCP(模型上下文協議)是一個通過標準化協議實現AI自動化的框架,包含主機、客戶端、服務器、本地數據源和遠程服務等關鍵組件。其核心在於服務器,它為客戶端提供上下文、工具和提示。MCP使AI代理能夠自動化執行任務,如代碼生成、調試以及與GitHub倉庫等外部服務交互。
LLM Gateway是一個基於MCP協議的服務器,支持高級AI代理(如Claude 3.7)將任務智能委託給成本更低的LLM模型(如Gemini Flash),實現成本優化和性能平衡。
Flashduty MCP Server是一個基於Model Context Protocol的服務器,提供與Flashduty API的無縫集成,支持事件管理和自動化功能。
Agent X是一個基於Google Gemini Flash和Twitter API的自主AI代理,能夠智能生成併發布推文。