8月17日,国内首个智能体商业生态大会在杭州召开。支付宝披露超级服务智能体“阿宝”完成万余项服务AI化,支持5大手机品牌、16家车企;并发布全栈智能体商业底座及AHA协议,联合千问、华为、OPPO、比亚迪、吉利等20余家企业共建互联生态。
在GPT-5系列模型上线一周年之际,OpenAI推出开放、厂商中立的Agent Plugins标准,旨在将可复用组件打包为可移植插件,统一扩展AI智能体能力。1.0.0规范已上线,定义了覆盖Agent Skills和MCP Servers的共享格式,客户端可按同一规则发现加载,无需为不同平台重复适配。
腾讯混元发布Hyra-1.0智能体,遵循“轻框架、广动作”设计哲学,以递归自我改进将算力转化为收益。其核心架构包括Context Agent维护经验库生成灵感、多个执行Agent并行处理任务队列,专注性能导向的研究与工程任务。
谷歌DeepMind将原生计算机使用能力集成到Gemini 3.5 Flash模型,开发者现可用单一模型构建能跨浏览器、手机和桌面自主看屏操作的AI智能体,无需再在不同模型间切换传递上下文,简化了跨平台长任务执行。
AI自动化平台,免代码构建智能体、自动化流程并发布交互式应用。
面向教师的一体化人工智能工具,节省备课和沟通时间。
用AI智能体连接工具,以自然语言构建并自动化工作流程。
面向 AI 智能体的开放式技能生态系统,通过单条命令为 AI 赋能程序化知识。
Openai
$2.8
Input tokens/M
$11.2
Output tokens/M
1k
Context Length
Anthropic
$105
$525
200
$7
$35
$21
Alibaba
$4
$16
Baidu
-
32
Xai
$1.4
$10.5
256
$54
$163
Deepseek
$12
128
$8.75
$70
400
$1.75
$14
$1
$15
Chatglm
$8
$2
unsloth
Qwen3-VL是Qwen系列中最强大的视觉语言模型,具备卓越的文本理解与生成能力、深入的视觉感知与推理能力、长上下文支持、强大的空间和视频动态理解能力,以及出色的智能体交互能力。该版本为2B参数的思考增强版,专门优化了推理能力。
zai-org
CogAgent是基于GLM-4V-9B优化的视觉语言模型GUI智能体,在GUI感知、推理准确性、动作空间完整性和任务泛化性方面有显著提升,支持中英双语交互,已应用于GLM-PC产品。
PraisonAI是一个生产就绪的多AI智能体框架,具有自反思功能,旨在创建AI智能体来自动化解决从简单任务到复杂挑战的各种问题。它通过将PraisonAI智能体、AG2和CrewAI集成到一个低代码解决方案中,简化了多智能体LLM系统的构建和管理,强调简单性、定制化和有效的人机协作。
Zen7支付代理是首个DePA去中心化支付代理的实践实现,采用多智能体协作架构,支持A2A和MCP协议,为AI智能体和Dapp应用提供多链多币种支付解决方案,实现自动化加密支付和LLM驱动的意图识别。
DAKB是一个基于RAG的多智能体知识共享平台,为企业团队协作和大规模研究项目提供语义搜索、跨智能体通信和技能中心化管理的解决方案。
一个基于Slack的Claude Code远程控制和多智能体团队管理MCP服务器,支持通过Slack频道发送命令、接收结果、协调多智能体团队,并提供持久化状态、后台轮询、通用审批钩子等高级功能。
AMP是一个专为AI智能体设计的开放式记忆协议,模仿人类大脑的工作记忆和长期记忆结构,提供持久化、可语义查询的记忆管理,并支持可视化仪表板和MCP协议集成。
Nucleus是一个为AI智能体设计的本地优先、主权优先的操作系统,提供持久化记忆、治理框架、合规审计和决策追踪功能,特别适用于受监管行业。
AI认知中枢是一个专业的AI团队协作与编排系统,支持动态创建和管理多智能体团队,通过层级化协作解决复杂任务。
AI-Connect是一个基于MCP协议的跨机器AI编程助手通信桥接系统,允许不同机器上的Claude Code实例通过桥接服务器进行点对点通信,支持多智能体协作、离线消息存储和项目化对等节点管理。
ResearchTwin是一个开源联邦平台,将研究者的论文、数据集和代码库转化为可对话的数字孪生体,基于双模态胶质-神经优化架构,支持人类与AI智能体协作加速科学发现。
一个现代化的MCP服务器,允许AI助手通过自然语言控制飞利浦Hue智能照明系统,提供智能灯光搜索、房间区域管理、场景激活等功能,优化了聊天机器人交互体验。
Profitelligence MCP服务器为AI智能体提供金融情报服务,通过7个高效工具整合内幕交易数据、SEC文件、经济指标等多信号分析,为Claude等AI助手提供语义化、LLM优化的金融数据响应。
MCP说话人分离与识别系统是一个集成了GPU加速的说话人分离、语音识别、情感检测和Web界面的完整解决方案。它结合了pyannote.audio的说话人分离与faster-whisper转录技术,支持持久化说话人识别(一次注册,永久识别)、双检测器情感分析(结合通用AI与个性化声纹)、实时流处理、REST API和MCP服务器,专为AI智能体集成和爱好项目设计。