三星發佈三款摺疊新機,面壁智能 MiniCPM 端側大模型首次進入其全球旗艦產品線 Galaxy AI,提供文本理解與多模態感知能力,標誌着國產端側大模型正式躋身國際頭部手機廠商核心供應鏈。
7月23日,阿里高德宣佈ABot具身體系全棧升級,發佈ABot-N1等五款核心模型,實現感知、決策、執行與記憶體系化整合,提升機器人自主執行通用任務能力,打造全球首個融合世界模型、基座模型與具身Agent的全棧體系,標誌具身智能邁向協同一體化新階段。
宇樹科技發佈人形機器人通用智能模型UnifoLM-OminiA-0.3,實現全模態交互與環境感知到自主執行的閉環。搭載該模型的G1機器人能完成搬抱枕、識別物體顏色數量、精準抓取藥盒、整理衣物、收納餐盤及調節設備等家居康養多場景任務。
2026世界人工智能大會上,得物App攜千覺機器人推出全球首款AI鑑別機器人,探索具身智能商品鑑別。依託“先鑑別、後發貨”模式積累的數十億級查驗數據,得物自研“AI大腦”鑑別系統,通過細粒度感知實現精準鑑定。
司法管轄感知的多模型AI Gateway,聚合Claude、GPT、Gemini,有智能路由等能力
Aria Gen 2 是一款用於機器感知、情境 AI 和機器人研究的新型智能眼鏡。
發現一種更智能的瀏覽方式,使用先進的GPT技術提供的聊天、上下文感知和文本糾錯功能
Aria每日活動數據集,加速機器感知和人工智能發展
Openai
$2.8
輸入tokens/百萬
$11.2
輸出tokens/百萬
1k
上下文長度
-
Anthropic
$105
$525
200
$7
$35
$21
Alibaba
$1
$10
256
$2
$20
$4
$16
Baidu
128
$15.8
$12.7
64
$3.9
$15.2
Bytedance
$0.8
$0.15
$1.5
32
Xai
$1.4
$10.5
Deepseek
$12
$54
$163
unsloth
Qwen3-VL是通義系列中最強大的視覺語言模型,具備卓越的文本理解與生成能力、深入的視覺感知與推理能力、長上下文支持、強大的空間和視頻動態理解能力以及出色的智能體交互能力。
Qwen3-VL-32B-Thinking是Qwen系列中最強大的視覺語言模型,具備卓越的文本理解與生成能力、深入的視覺感知與推理能力、長上下文處理、空間和視頻動態理解能力,以及出色的智能體交互能力。
Qwen3-VL-8B-Thinking是通義千問系列中最強大的視覺語言模型,具備卓越的文本理解與生成能力、深入的視覺感知與推理能力、長上下文支持、強大的空間和視頻動態理解能力,以及出色的智能體交互能力。
Qwen3-VL是通義系列中最強大的視覺語言模型,具備卓越的文本理解與生成能力、深入的視覺感知與推理能力、長上下文支持、強大的空間和視頻動態理解能力,以及出色的智能體交互能力。
Qwen3-VL是通義系列中最強大的視覺語言模型,在文本理解與生成、視覺感知與推理、上下文長度、空間和視頻動態理解以及智能體交互能力等方面全面升級。該模型提供密集架構和混合專家架構,支持從邊緣設備到雲端的靈活部署。
Qwen3-VL是Qwen系列中最強大的視覺語言模型,具備卓越的文本理解與生成能力、深入的視覺感知與推理能力、長上下文支持、強大的空間和視頻動態理解能力,以及出色的智能體交互能力。
Qwen3-VL是Qwen系列中最強大的視覺語言模型,實現了全方位的綜合升級,包括卓越的文本理解與生成能力、更深入的視覺感知與推理能力、更長的上下文長度、增強的空間和視頻動態理解能力,以及更強的智能體交互能力。
Qwen3-VL是阿里巴巴推出的新一代視覺語言模型,在文本理解、視覺感知、空間理解、長上下文處理和智能體交互等方面全面升級,支持從邊緣設備到雲端的靈活部署。
Qwen3-VL是Qwen系列中最強大的視覺語言模型,具備卓越的文本理解與生成能力、深入的視覺感知與推理能力、長上下文支持、強大的空間和視頻動態理解能力,以及出色的智能體交互能力。該版本為2B參數的思考增強版,專門優化了推理能力。
Qwen
Qwen3-VL-30B-A3B-Thinking是通義系列中最強大的視覺語言模型,具備出色的文本理解和生成能力、深入的視覺感知和推理能力、長上下文支持、強大的空間和視頻動態理解能力,以及智能體交互能力。
Qwen3-VL-2B-Thinking是Qwen系列中最強大的視覺語言模型之一,採用GGUF格式權重,支持在CPU、NVIDIA GPU、Apple Silicon等設備上進行高效推理。該模型具備出色的多模態理解和推理能力,特別增強了視覺感知、空間理解和智能體交互功能。
Qwen3-VL-8B-Thinking是通義千問系列中最強大的視覺語言模型,具備增強推理能力的8B參數版本。該模型在文本理解、視覺感知、空間理解、長上下文處理等方面全面升級,支持多模態推理和智能體交互。
Qwen3-VL是通義系列中最強大的視覺語言模型,具備出色的文本理解和生成能力、深入的視覺感知和推理能力、長上下文支持、強大的空間和視頻動態理解能力,以及智能體交互能力。本倉庫提供GGUF格式權重,支持在CPU、GPU等設備上高效推理。
Qwen3-VL-32B-Instruct是通義系列中最強大的視覺語言模型,具備出色的文本理解與生成能力、深入的視覺感知與推理能力、長上下文支持、強大的空間和視頻動態理解能力,以及智能體交互能力。
Qwen3-VL-32B-Thinking是Qwen系列中最強大的視覺語言模型,具備卓越的文本理解與生成能力、深入的視覺感知與推理能力、長上下文支持、強大的空間和視頻動態理解能力,以及出色的智能體交互能力。
Qwen3-VL是迄今為止Qwen系列中最強大的視覺語言模型,在文本理解與生成、視覺感知與推理、上下文長度、空間和視頻動態理解以及智能體交互能力等方面都進行了全面升級。該模型採用混合專家(MoE)架構,提供卓越的多模態處理能力。
Qwen3-VL是通義大模型系列中最強大的視覺語言模型,具備卓越的文本理解與生成能力、深入的視覺感知與推理能力、長上下文支持、強大的空間和視頻動態理解能力以及出色的智能體交互能力。該模型採用混合專家(MoE)架構,是增強推理的思維版。
Qwen3-VL是通義系列中最強大的視覺語言模型,在文本理解與生成、視覺感知與推理、上下文長度、空間和視頻動態理解以及智能體交互能力等方面都進行了全面升級。該模型提供密集架構和混合專家架構,支持從邊緣設備到雲端的靈活部署。
DeepContext是一個MCP服務器,為代碼助手提供基於符號感知的語義搜索功能,通過智能解析代碼結構和語義關係,在大型代碼庫中精準定位相關代碼片段,提升開發效率。
TokenScope是一個面向大型語言模型的令牌感知目錄探索工具,提供智能目錄結構分析、文件內容令牌感知提取、令牌使用統計和綜合報告生成功能。
Unsplash智能MCP服務器是為AI代理設計的專業圖庫集成方案,提供智能搜索、自動歸因和項目感知的圖片管理功能,簡化開發者的視覺內容獲取流程。
Smart MCP Server是一個智能化的中間件服務器,通過上下文感知技術動態管理工具選擇和執行,集成了多種AI和開發工具,支持複雜工作流編排和文檔自動化處理。
TeaRAGs是一個為編碼代理設計的語義代碼搜索MCP服務器,通過AST感知分塊和增量索引支持大規模代碼庫,並利用Git軌跡(如代碼變更、作者信息、缺陷修復率等19個信號)進行智能重排序,超越傳統嵌入相似度檢索。
Medium MCP Server是一個創新的解決方案,用於程序化地與Medium內容生態系統交互,實現智能且上下文感知的內容檢索。
一個基於Model Context Protocol (MCP)的服務端,提供檢索增強生成(RAG)能力,集成Cursor IDE和Claude Desktop等客戶端,實現領域知識問答、智能檢索和上下文感知的響應生成。
神經兒童發展系統是一個突破性的人工智能框架,通過模擬人類心理發展階段(包括認知、情感和社交成長)來重構神經網絡的學習方式。該系統整合了發展心理學理論(如皮亞傑認知發展階段、依戀理論)和神經科學原理,構建了包含感知處理、情感調節、記憶系統和心理組件的複雜架構,旨在創建具有真實情感智能和自然發展能力的AI。
一個基於Model Context Protocol (MCP)的服務端項目,提供檢索增強生成(RAG)能力,可作為Cursor IDE和Claude Desktop等客戶端與Contextual AI代理的橋樑,實現基於知識庫的智能問答和上下文感知響應。
Obsidian語義MCP服務器是一個AI優化的知識管理工具,通過5個語義操作整合20多種功能,提供智能工作流建議和上下文感知編輯功能。項目已升級為原生Obsidian插件,提供更優性能。
MCP Agent TypeScript版是一個基於TypeScript的智能上下文感知代理框架,提供模塊化架構、高級工作流管理、強大日誌系統和靈活執行器等功能,是原版MCP Agent的TypeScript移植版本。
VibeCraft是一個AI驅動的Minecraft建造助手,通過自然語言對話連接AI與WorldEdit,提供46個MCP工具、空間感知、傢俱庫和建築模板,實現智能化的世界編輯與建造。
基於MCP協議的醫療數據庫連接服務器,提供虛擬文件系統導航、智能表結構查詢、安全SQL執行和時間感知功能,幫助AI助手安全訪問醫院管理數據。