Kimi Code桌面客户端同步上线macOS和Windows版,访问kimi.com/code即可安装。其面向开发者工作流,内置终端、浏览器和Git状态查看,支持运行调试项目、审阅代码改动,并可关联PR状态跟踪评审与合并进度。
宇树科技创始人王兴兴在2026世界机器人大会透露,公司将推进物理AI机器人模型自进化,探索用AI大模型自动生成机器人控制代码。登陆科创板次日他表示,计划以前沿大模型为核心,自定义规则、经验框架和约束工具,自主检索最新论文、成果及开源方案,生成代码并经模型自评与人工评审。
近日,“OpenClaw AI Agent 小龙虾能力排行榜”在AI圈引发关注。该榜单聚焦真实场景,通过统一任务集测试主流大模型在OpenClaw框架下的编码任务成功率,为开发者提供参考。评测采用自动化代码检查与LLM智能评审相结合的方式,确保结果客观、可复现且无人工干预。
苹果在ICLR2025提交的视觉推理论文宣称超越GPT-5,但遭研究员复现揭露严重问题:官方代码缺失图片输入模块,修复后准确率暴跌;抽查发现30%标注数据存在错误。作者团队在GitHub草率关闭问题反馈后,最终承认数据生成流程存在缺陷。该事件暴露论文评审机制漏洞,引发学界对AI研究可复现性的担忧。(140字)
Openai
$2.8
Input tokens/M
$11.2
Output tokens/M
1k
Context Length
Xai
$1.4
$3.5
2k
$7.7
$30.8
200
-
Anthropic
$7
$35
Google
$2.1
$17.5
$21
$105
$0.7
Alibaba
$4
$16
$1
$10
256
Baidu
128
$6
$24
$2
$20
Moonshot
Bytedance
$0.8
32
all-hands
基于Qwen2.5-Coder-32B-Instruct微调的评审模型,用于评估代码解决方案质量,助力SWE-Bench基准测试取得SOTA成绩
一个用于GitLab代码审查的MCP服务器,支持AI助手通过GitLab API审查合并请求,提供完整的变更分析、文件差异比较和评审管理功能。
Yellhorn MCP是一个模型上下文协议服务器,通过集成Gemini和OpenAI能力为代码助手提供全代码库上下文支持,实现开发任务规划、代码评审和隔离环境创建。
MAGI MCP Server是一个基于Model Context Protocol (MCP)的代码审查系统服务器实现,提供标准化的代码提交和审查流程接口,支持多代理评审和多数决策机制。
一个基于Model Context Protocol的多模型AI代码审查与分析服务器,支持OpenAI、Anthropic、Google Gemini等多种AI模型并行执行代码质量检查、安全分析和多智能体共识评审。
Bitbucket MCP服务器是一个提供与Bitbucket API交互工具的服务,支持Bitbucket Cloud和Server,包含PR生命周期管理、分支管理、文件操作和代码评审等功能。
一个基于MCP协议的多智能体辩论框架,用于代码审查和辩论规划,通过并行执行多个AI代理(如Claude、Codex)进行代码评审,采用确定性评分系统(P0/P1/P2严重性分级)和平台特定规则,最终合并结果生成评审报告。
基于Gemini的MCP服务器,提供代码审查、分析、文档生成和逻辑验证功能,支持PR评审、代码异味检测、复杂度分析等13个工具。