谷歌AMIE医疗AI系统在实时临床视频问诊中实现突破,可综合捕捉患者言语、咳嗽、步态等多元信息,展现专家级诊断能力。该系统基于Gemini与Project Astra架构,采用多智能体协作模式,标志着医疗AI向多模态临床实践迈出关键一步。
阿里达摩院启动“阿里星”计划,面向2027届毕业生,开放AI芯片、新型CPU架构、医疗多模态智能体、AGI决策等15项前沿课题,重点布局AI芯片编程模型、编译器及面向大模型的AI SoC架构,吸引顶尖人才探索下一代人工智能技术。
微软纳德拉在财报会上称,将力推多模型架构,加大自研AI模型、智能体及安全产品投入,以降低对单一前沿AI实验室的依赖。财务方面,微软全年营收3318亿美元、净利1337亿美元,最新季度营收900亿美元、净利358亿美元,AI业务高速扩张背景下,公司仍保持全球云服务领先地位。
Cursor公布新版AI智能体集群测试:仅凭SQLite文档,用Rust重建SQLite,测试通过率达100%,远超旧版。集群已随Cursor3升级为核心产品,支持开发者并行运行多个智能体协同开发,新架构强调规划能力。
Openai
$2.8
输入tokens/百万
$11.2
输出tokens/百万
1k
上下文长度
Xai
$1.4
$3.5
2k
-
Anthropic
$105
$525
200
$7
$35
$21
Alibaba
$4
$16
$1
$10
256
$2
$20
$3.9
$15.2
64
Bytedance
$0.8
128
$0.15
$1.5
Baidu
32
$10.5
$8
Deepseek
$12
unsloth
Qwen3-VL是迄今为止Qwen系列中最强大的视觉语言模型,在文本理解与生成、视觉感知与推理、上下文长度、空间和视频动态理解以及智能体交互能力等方面都进行了全面升级。该模型采用混合专家(MoE)架构,提供卓越的多模态处理能力。
Sci-fi-vy
GPT-OSS-20B是OpenAI推出的开放权重模型,专为强大推理、智能体任务和多样化开发者用例设计。该模型具有210亿参数(其中36亿为活跃参数),采用混合专家架构,支持低延迟本地部署和特定场景应用。
Qwen
Qwen3是通义千问系列最新一代大语言模型,提供完整稠密模型与混合专家(MoE)架构。经过海量训练,Qwen3在推理、指令遵循、智能体能力和多语言支持方面实现突破性进展。
nvidia
这是DeepSeek AI的DeepSeek V3-0324模型的量化版本,采用优化的Transformer架构,通过FP4量化技术显著减少了模型大小和GPU内存需求,适用于AI智能体系统、聊天机器人等多种AI应用场景。
QuixiAI
Qwen3-30B-A3B-AWQ是基于Qwen3-30B-A3B模型的AWQ量化版本,是通义系列最新一代大语言模型。该模型采用专家混合(MoE)架构,支持思考模式和非思考模式的双模式切换,在推理、指令遵循、智能体能力和多语言支持方面表现优异。
yukiarimo
Yuna Ai V4是一款基于LLaMA 3.1 8B架构的多语言文本生成模型,专注于提供智能对话和知识问答体验。经过3B+令牌训练,具备量子思维等先进特性,在对话能力和创造力方面表现突出。
alpindale
WizardLM-2 8x22B 是微软AI开发的下一代最先进大语言模型,采用专家混合(MoE)架构,在复杂对话、多语言、推理和智能体任务上表现优异。
Zen7支付代理是首个DePA去中心化支付代理的实践实现,采用多智能体协作架构,支持A2A和MCP协议,为AI智能体和Dapp应用提供多链多币种支付解决方案,实现自动化加密支付和LLM驱动的意图识别。
Swarms API 是一个用于构建、部署和管理多智能体系统的REST API,支持多种AI模型和群架构,提供实时监控、批量处理和任务调度等功能。
AWorld是一个多智能体系统框架,旨在弥合理论MAS能力与实际应用之间的差距,提供从单智能体到多智能体协作/竞争的全套解决方案。项目支持浏览器/手机操作、GAIA基准测试等场景,采用客户端-服务器架构,集成丰富工具链,并包含性能评估与训练功能。
企业级多智能体编排MCP服务器,用于协调架构、质量、云和提示等专业代理,实现自主软件开发、测试和部署,具备自愈、认证和分析功能。
CastPlan MCP是一个AI驱动的智能编程环境,通过四层架构实现自然流畅的'氛围编程'体验,让AI深度理解项目上下文并提供智能辅助,支持多语言团队协作和自动化工作流。