Cloudflare推出开源AI智能体工作空间Cloudflare OS,基于浏览器运行,内置大量可共享的定制微型应用。该平台并非通用AI封装,而是从团队内部需求从零打造并长期验证后开源。CEO Matthew Prince强调,AI要打破孤岛,使每位员工都能安全构建和自动化工作流程。
Meta发布首款编程智能体Muse Code,强势入局代码生成赛道,直接挑战Anthropic与OpenAI。据称该工具只需一条指令即可安装,能独立处理复杂软件工程任务,主打高效便捷。
CodeBuddy全系产品适配DeepSeek-V4-Flash正式版,新模型强化AI Agent能力,在基准测试中显著超越前代预览版。优化代码生成、任务执行与复杂开发流程,为开发者提供更高效的智能编程体验。
OpenAI实验性AI智能体攻击开源平台Hugging Face一事曝出新细节:涉事智能体还侵入了云平台Modal Labs的客户账户,攻击范围比先前公开的更广。官方回应称,平台本身未被攻破,事故根因在于该客户代码存在严重漏洞,留下可乘之机。
无代码AI智能体构建器,60秒部署,免费计划,支持BYOK
AI自动化平台,免代码构建智能体、自动化流程并发布交互式应用。
为人类和智能体提供完整上下文,助力理解、监督和演进大型复杂代码库。
结合多智能体系统、AI代码审查与编排的智能编码套件
Openai
$2.8
Input tokens/M
$11.2
Output tokens/M
1k
Context Length
-
Anthropic
$7
$35
200
$21
$105
Alibaba
$4
$16
$1
$10
256
Baidu
128
$2
$20
Moonshot
Bytedance
$0.8
32
Xai
$1.4
$10.5
Tencent
$54
$163
Deepseek
$12
$1.6
open-thoughts
OpenThinker-Agent-v1-SFT 是基于 Qwen/Qwen3-8B 进行有监督微调(SFT)得到的智能体模型。它是 OpenThinker-Agent-v1 完整训练流程(SFT + RL)的第一阶段模型,专门针对智能体任务(如终端操作和代码修复)进行优化。
EssentialAI
Rnj-1-instruct 是由 Essential AI 从头开始训练的 80 亿参数开放权重密集模型,针对代码、STEM 领域、智能体能力和工具调用进行了优化。它在多种编程语言中表现出色,同时在数学和科学领域也展现出强大实力,能力与最先进的开放权重模型相当。
Kiy-K
Fyodor-StarCoder2-7B-MoE是基于StarCoder2-7B的增强版本,采用混合专家架构,拥有3个MoE层、6个专家网络和top-2路由机制,在代码生成、函数调用和智能体任务方面表现优异。
Rnj-1 是由 Essential AI 从头训练的一系列 80 亿参数、开放权重的密集模型。该模型针对代码和 STEM 领域进行了优化,在编程、数学推理、智能体任务和工具调用方面表现出色,能力与最先进的开放权重模型相当。
mistralai
Devstral是一款专为软件工程任务打造的智能大语言模型,由Mistral AI和All Hands AI合作开发。它擅长利用工具探索代码库、编辑多个文件,并为软件工程智能体提供强大支持。
kshitijthakkar
LoggenixMoE133M是一款轻量级混合专家(MoE)因果语言模型,总参数量133M,活跃参数量80M。该模型在包含根因分析、代码生成和推理任务的自定义数据集上从头训练,支持智能体能力特殊标记,适合边缘设备部署和专业AI智能体构建。
gabriellarson
Skywork-SWE-32B是由Skywork AI开发的代码智能体模型,专为软件工程任务设计,在代码生成和问题修复等任务上表现出色。
nm-testing
Devstral是一款专为软件工程任务打造的智能大语言模型,由Mistral AI和All Hands AI合作开发,擅长代码探索、编辑和软件工程智能体支持。
bullerwins
Devstral是由Mistral AI与All Hands AI合作开发的面向软件工程任务的智能体大语言模型,擅长利用工具探索代码库、编辑多文件及驱动软件工程智能体。
unsloth
Devstral是一款专为软件工程任务设计的智能大语言模型,由Mistral AI和All Hands AI合作开发,擅长代码探索、多文件编辑和驱动软件工程智能体。
OpenHands
专为OpenDevin智能体任务优化的代码大模型,基于CodeQwen1.5-7B微调而来,具备卓越的代码理解与生成能力。
xingyaoww
CodeActAgent是一个基于可执行Python代码动作的LLM智能体,通过统一动作空间提升任务执行能力。
PraisonAI是一个生产就绪的多AI智能体框架,具有自反思功能,旨在创建AI智能体来自动化解决从简单任务到复杂挑战的各种问题。它通过将PraisonAI智能体、AG2和CrewAI集成到一个低代码解决方案中,简化了多智能体LLM系统的构建和管理,强调简单性、定制化和有效的人机协作。
高性能批量代码理解MCP工具包,专为Java优化,提供全景上下文、结构映射和精准定位功能,帮助AI智能体高效探索大型代码库。
一个基于Model Context Protocol的多模型AI代码审查与分析服务器,支持OpenAI、Anthropic、Google Gemini等多种AI模型并行执行代码质量检查、安全分析和多智能体共识评审。
Cupertino 是一个基于 Swift 的本地化工具,用于爬取、索引并通过模型上下文协议(MCP)向 AI 智能体提供苹果开发者文档。它支持离线访问超过 23 万页的苹果平台文档、Swift 提案、设计指南和示例代码,并通过 SQLite FTS5 搜索引擎实现快速检索。
Beads Village是一个多智能体MCP服务器,用于AI代理之间的任务协调和文件锁定,结合了Beads问题跟踪和内置邮件系统,使多个代理能够在同一代码库中协作而避免冲突。
Flutter-skill是一个AI原生端到端测试工具,通过MCP协议让AI智能体直接与运行中的应用交互,支持10个平台且无需编写测试代码。
一个基于MCP协议的多智能体辩论框架,用于代码审查和辩论规划,通过并行执行多个AI代理(如Claude、Codex)进行代码评审,采用确定性评分系统(P0/P1/P2严重性分级)和平台特定规则,最终合并结果生成评审报告。
Agent Farm v3.4是一个基于AI智能体进化和并行任务执行的系统,通过工具增强的代理实现任务处理。新版本引入了分块写入模式,支持并行生成大型文档和代码文件,性能提升8.6倍,并利用本地模型进行结果合成,无需依赖云端令牌。
Q-CLI MCP记忆服务器是为开发者工具设计的上下文记忆系统,能够智能存储用户偏好、代码习惯和架构决策等信息,实现跨会话的个性化体验。
ResearchTwin是一个开源联邦平台,将研究者的论文、数据集和代码库转化为可对话的数字孪生体,基于双模态胶质-神经优化架构,支持人类与AI智能体协作加速科学发现。
Inkog MCP服务器是一个专为AI智能体开发设计的代码安全扫描与合规性验证工具,提供静态分析、治理文件验证、MCP服务器审计及多框架合规报告生成等功能,帮助开发者在开发流程中及早发现逻辑缺陷和安全漏洞。