Meta发布AI编程代理Muse Code,面向大型代码库,支持从任务规划、编写到验证的端到端开发流程。该工具基于Muse Spark模型,通过终端命令安装,目前处于测试阶段,旨在提升复杂软件项目的工程效率。
CodeBuddy全系产品适配DeepSeek-V4-Flash正式版,新模型强化AI Agent能力,在基准测试中显著超越前代预览版。优化代码生成、任务执行与复杂开发流程,为开发者提供更高效的智能编程体验。
Anthropic更新编程工具Claude Code,新增支持苹果iOS模拟器并开放公测。开发者下达指令后,Claude可直接启动应用、实时监控画面并进行交互,自动完成代码迭代直至项目完成,实现无需复杂操作的端到端开发。
Anthropic旗下编程工具Claude Code迎来更新,正式引入苹果iOS模拟器支持并向公众开放测试。开发者构建、运行或检查应用时,可直接在专属模拟器面板中打开,无需切换工具,将显著改变开发工作流程。
强大的开源Kimi K2聊天平台,通过Kimi AI在编程和数学基准测试中超越GPT-4。企业级Kimi AI,成本降低95%。
Codeaid是一款革新编程测试体验的编程测试和评估平台。
AI编程助手,支持整个软件开发生命周期,加速代码编写,提高生产力,自动化测试和DevOps集成。
Qodo Gen 是一款 AI 驱动的 IDE 插件,帮助开发者生成高质量代码和测试用例。
Openai
$2.8
Input tokens/M
$11.2
Output tokens/M
1k
Context Length
$7.7
$30.8
200
-
Anthropic
$105
$525
$7
$35
$21
Alibaba
$4
$16
Moonshot
256
Bytedance
Xai
$1.4
$10.5
Deepseek
$12
128
32
$0.75
$8.75
$70
400
$1
$0.8
$8
Chatglm
facebook
MobileLLM-R1是Facebook推出的高效推理模型系列,专注于数学、编程和科学问题解决。该模型在仅使用约2T高质量标记进行预训练的情况下,在多项基准测试中取得了优异性能。
Sci-fi-vy
DeepSeek-R1-0528是DeepSeek R1系列的小版本升级模型,通过增加计算资源和算法优化显著提升了推理深度和能力,在数学、编程等多个基准测试中表现出色。
unsloth
基于强化学习训练的数学与编程推理模型,在多项基准测试中表现优异
ibm-granite
IBM Granite 8B代码指令模型是一个专注于代码生成和解释的AI模型,支持多种编程语言,在HumanEval等基准测试中表现优异。
professorf
Phi-1是一个专门用于Python编码的13亿参数Transformer模型,提供GGUF格式量化版本,支持CPU+GPU推理。该模型在简单Python编码基准测试HumanEval上的准确率超过50%,专注于基础Python编程任务。
WhiteRabbitNeo
三位一体是一款通用编程人工智能,在HumanEval测试中达到70分。
glaiveai
Glaive-coder-7b是一个拥有70亿参数的代码生成模型,基于CodeLlama-7b模型微调而来。该模型使用约14万个编程相关的问题及解决方案数据集进行训练,这些数据由Glaive的合成数据生成平台产出。在HumanEval测试中达到63.1%的pass@1,在MBPP测试中达到45.2%的pass@1。
microsoft
Phi-1是一个13亿参数的Transformer模型,专为Python基础编程设计,在HumanEval基准测试中准确率超过50%
PMAT是一个零配置的AI代码上下文生成工具,提供代码质量分析、技术债务评级、突变测试、仓库健康评分和语义搜索等功能,支持17种以上编程语言,并能通过MCP协议与Claude Code等AI助手集成。
VibeCheck Web测试工具是一个AI驱动的网页测试代理,通过MCP协议集成到AI编程助手(如GitHub Copilot、Cursor等)中,实现自动化测试录制、执行和发现。它利用Playwright控制浏览器,支持自然语言描述生成测试脚本,执行回归测试,并自动发现潜在测试步骤,提高开发效率和测试准确性。
NetContextServer是一个增强AI编程助手理解.NET代码库的工具,通过Model Context Protocol (MCP)提供深度代码分析、语义搜索和测试覆盖率分析等功能。
一个用于AI辅助编程的MCP服务器,通过整合开发历史数据(Git提交、测试结果、Copilot会话)到可搜索的SQLite数据库,让AI助手能够访问和分析开发历史。
VibeCheck Web测试工具是一个AI驱动的网页测试代理,旨在简化开发者的网页测试流程。它通过MCP协议与AI编程助手集成,支持自动化测试录制、执行和发现,帮助开发者快速识别和修复代码问题。
Calva MCP Server是一个VS Code扩展,为Clojure/ClojureScript开发提供AI编程助手功能,通过连接REPL实现交互式编程,让AI能够实时执行和测试代码。
Test Coverage MCP是一个为AI编程代理提供测试覆盖率数据的MCP服务器,支持解析LCOV格式文件,让代理在编码时能实时查看覆盖率变化,避免覆盖率下降并追踪改进进度。
Yamu是一个实验性的MCP服务器项目,旨在让AI编程助手能够与Unity项目进行交互,提供编译和测试功能,支持编辑-编译-调试的自动化循环。
Gradle MCP Server是一个基于Gradle Tooling API的服务,允许AI工具以编程方式与Gradle项目交互,提供项目信息查询、任务执行和测试运行功能。
YAML声明式API测试框架,专为AI编程助手优化,通过MCP服务器与Claude/Cursor等编辑器无缝集成,实现高效API测试生成与执行
Calva MCP Server是一个VS Code扩展,为Clojure/ClojureScript开发者提供AI编程助手与REPL交互的能力,使AI能够实时执行和测试代码,提升编程效率。
该项目是用于测试和探索模型上下文协议(MCP)服务器实现的GitHub仓库,包含多种编程语言学习、DevOps工具、游戏开发及AI相关的子项目。
一个用于处理编程辅助任务的智能代理,支持知识管理、文档驱动开发、代码审查和测试管理等功能。
LAMDA是一个功能强大的Android逆向工程与自动化框架,旨在简化安全分析和应用测试流程,提供编程化接口替代手动操作,支持远程控制、网络代理、UI自动化等多种功能。
Playwright是一个跨浏览器的Web测试和自动化框架,支持Chromium、Firefox和WebKit,提供无头执行、多浏览器兼容性测试、强大的断言和工具支持,适用于多种编程语言。