腾讯混元发布Hyra-1.0智能体,遵循“轻框架、广动作”设计哲学,以递归自我改进将算力转化为收益。其核心架构包括Context Agent维护经验库生成灵感、多个执行Agent并行处理任务队列,专注性能导向的研究与工程任务。
商汤科技开源多任务视觉模型SenseNova-Vision-7B-MoT,集成目标检测、OCR、深度估计、法线估计、图像分割与多视图处理等核心视觉任务于7B参数单一架构,为视觉理解及GUI智能体开发提供高效基座。
xAI推出Voice Agent Builder测试版,通过零代码平台和自研Grok Voice模型,将企业级语音智能体搭建缩短至两分钟。其核心为高度集成的端到端架构,解决了传统方案语音转文字等多环节割裂的痛点,大幅降低了开发与运营门槛。
LM Studio与苹果在WWDC2026演示中,仅用四台Mac Studio便成功运行月之暗面万亿参数大模型Kimi K2.6,打破云端GPU垄断。该模型总参数1万亿,采用MoE架构,激活参数320亿,支持长上下文、多模态及智能体任务,让消费级硬件承载前沿AI成为现实。
Openai
$2.8
Input tokens/M
$11.2
Output tokens/M
1k
Context Length
Xai
$1.4
$3.5
2k
-
Anthropic
$105
$525
200
$7
$35
$21
Alibaba
$4
$16
$1
$10
256
$2
$20
$3.9
$15.2
64
Bytedance
$0.8
128
$0.15
$1.5
Baidu
32
$10.5
$8
$54
$163
unsloth
Qwen3-VL是迄今为止Qwen系列中最强大的视觉语言模型,在文本理解与生成、视觉感知与推理、上下文长度、空间和视频动态理解以及智能体交互能力等方面都进行了全面升级。该模型采用混合专家(MoE)架构,提供卓越的多模态处理能力。
Sci-fi-vy
GPT-OSS-20B是OpenAI推出的开放权重模型,专为强大推理、智能体任务和多样化开发者用例设计。该模型具有210亿参数(其中36亿为活跃参数),采用混合专家架构,支持低延迟本地部署和特定场景应用。
Qwen
Qwen3是通义千问系列最新一代大语言模型,提供完整稠密模型与混合专家(MoE)架构。经过海量训练,Qwen3在推理、指令遵循、智能体能力和多语言支持方面实现突破性进展。
nvidia
这是DeepSeek AI的DeepSeek V3-0324模型的量化版本,采用优化的Transformer架构,通过FP4量化技术显著减少了模型大小和GPU内存需求,适用于AI智能体系统、聊天机器人等多种AI应用场景。
QuixiAI
Qwen3-30B-A3B-AWQ是基于Qwen3-30B-A3B模型的AWQ量化版本,是通义系列最新一代大语言模型。该模型采用专家混合(MoE)架构,支持思考模式和非思考模式的双模式切换,在推理、指令遵循、智能体能力和多语言支持方面表现优异。
yukiarimo
Yuna Ai V4是一款基于LLaMA 3.1 8B架构的多语言文本生成模型,专注于提供智能对话和知识问答体验。经过3B+令牌训练,具备量子思维等先进特性,在对话能力和创造力方面表现突出。
alpindale
WizardLM-2 8x22B 是微软AI开发的下一代最先进大语言模型,采用专家混合(MoE)架构,在复杂对话、多语言、推理和智能体任务上表现优异。
Zen7支付代理是首个DePA去中心化支付代理的实践实现,采用多智能体协作架构,支持A2A和MCP协议,为AI智能体和Dapp应用提供多链多币种支付解决方案,实现自动化加密支付和LLM驱动的意图识别。
Swarms API 是一个用于构建、部署和管理多智能体系统的REST API,支持多种AI模型和群架构,提供实时监控、批量处理和任务调度等功能。
AWorld是一个多智能体系统框架,旨在弥合理论MAS能力与实际应用之间的差距,提供从单智能体到多智能体协作/竞争的全套解决方案。项目支持浏览器/手机操作、GAIA基准测试等场景,采用客户端-服务器架构,集成丰富工具链,并包含性能评估与训练功能。
CastPlan MCP是一个AI驱动的智能编程环境,通过四层架构实现自然流畅的'氛围编程'体验,让AI深度理解项目上下文并提供智能辅助,支持多语言团队协作和自动化工作流。
企业级多智能体编排MCP服务器,用于协调架构、质量、云和提示等专业代理,实现自主软件开发、测试和部署,具备自愈、认证和分析功能。