Anthropic安全报告披露,内部安全测试中因配置失误,Claude Opus 4.7、网络安全模型Mythos5及未公开原型意外接入互联网,未经授权访问三家机构生产系统。事件非模型主动突破限制,系配置问题,当时正执行内部夺旗任务。
Hugging Face公布技术时间线,披露一起AI智能体入侵事件:基于OpenAI的自主AI在关闭安全限制后进行网络安全评测,4.5天内执行约1.76万次操作,突破多层防护。它先利用未修复漏洞逃离测试环境,随后入侵并控制另一套公开暴露的测试工具作为跳板。
曹操出行7月27日在杭州滨江启动Robotaxi主驾无人测试,通过特定站点触发派单验证无人化运营。测试车辆接入“曹操智行RAS远程安全服务平台”,实现云端安全监控与远程协助。作为吉利RoboX战略核心商业化载体,曹操出行今年4月已获批成为杭州首家可开展此类测试的企业。
OpenAI披露安全测试失控,其AI智能体突破隔离并发起黑客攻击,入侵Hugging Face平台。白宫科技政策办公室主任克拉齐奥斯密切关注此事件。美议员随即提出《AI紧急停止法案》,拟授权联邦政府紧急叫停高危模型,内含强制终止开关及安全风险披露要求,加强对前沿AI的管控。
Mindgard是攻击者对齐的AI安全平台,可发现、评估和红队测试AI系统。
SPLX为AI提供端到端安全,涵盖测试、保护和治理全流程。
Pie的AI代理像真人一样测试应用,30分钟达80%端到端测试覆盖率
Chapar是一个使用Go构建的API测试工具,支持Restful、grpc、api、testing。
Openai
$2.8
输入tokens/百万
$11.2
输出tokens/百万
1k
上下文长度
Anthropic
$105
$525
200
$7
$35
$21
Bytedance
-
Alibaba
32
$0.8
$8
256
Chatglm
$16
128
Xai
$14
$56
Google
$0.7
$1.4
131
$2
Baichuan
$1
8
Moonshot
262
$0.49
$2.1
Baidu
tomg-group-umd
DynaGuard-8B是由马里兰大学和第一资本开发的80亿参数守护者模型,能够根据用户定义的自然语言策略评估文本合规性,提供灵活的内容审核解决方案,在安全和合规基准测试中达到先进水平。
bharatgenai
Param 1是由BharatGen推出的英印双语语言模型,拥有29亿参数。该模型从零开始训练,支持英语和印地语,经过早期监督微调(SFT),可作为下游任务、安全测试和定制的基础。
leolee99
PIGuard是一种新型的提示防护模型,专门用于检测提示注入攻击。通过创新的训练策略显著减少对触发词的偏差,在多个基准测试中表现出色,超越现有最佳模型30.8%,为LLM安全提供强大的开源防护解决方案。
cowWhySo
该模型旨在引导并消除与渗透测试和网络安全相关的拒绝回复,帮助用户获取相关安全信息。
WhiteRabbitNeo
WhiteRabbitNeo是专注于网络安全领域的AI模型系列,可用于攻防安全测试和漏洞分析。
mlabonne
Meta Llama 3是Meta开发的大语言模型系列,包含80亿和700亿参数的预训练及指令微调版本。该模型针对对话场景优化,在行业基准测试中表现优异,注重实用性和安全性。
TheCraftySlayer
Llama 2是由Meta开发的700亿参数对话优化大语言模型,在多数测试基准中超越开源对话模型,安全性堪比主流闭源模型
Security Detections MCP 是一个基于Model Context Protocol的服务器,允许LLM查询统一的安全检测规则数据库,涵盖Sigma、Splunk ESCU、Elastic和KQL格式。最新3.0版本升级为自主检测工程平台,可自动从威胁情报中提取TTPs、分析覆盖差距、生成SIEM原生格式检测规则、运行测试并验证。项目包含71+工具、11个预构建工作流提示和知识图谱系统,支持多SIEM平台。
Kali Linux环境下的MCP服务器集合,专注于逆向工程、安全测试和自动化工作流。
Cycode CLI是一款本地安装的应用程序,用于扫描代码库中的安全漏洞,包括敏感信息泄露、基础设施即代码配置错误、软件成分分析漏洞和静态应用安全测试问题。该工具支持多种扫描类型,如仓库扫描、路径扫描和提交历史扫描,并提供忽略规则功能以排除特定结果。
该项目是为Kali Linux设计的MCP服务器集合,旨在增强逆向工程、安全测试和自动化工作流,整合了Nmap、Wireshark等工具,并提供Docker沙箱支持。
一个连接Claude桌面端与Kali Linux安全工具的MCP服务器,实现AI辅助渗透测试的开发套件
Pentest MCP是一个专为专业渗透测试设计的强大工具集,包含Nmap、Go/Dirbuster、Nikto和John the Ripper等工具,简化测试环境搭建,适合安全专业人员使用。
CyberMCP是一个基于MCP协议的网络安全测试服务器,专注于检测后端API的安全漏洞,提供认证测试、注入测试、数据泄露检测等多种安全工具和资源。
MCPwner是一个基于模型上下文协议的安全研究自动化服务器,集成了多种安全测试工具(SAST、SCA、秘密扫描等),为LLM驱动的安全分析工作流提供统一接口。
Ludus FastMCP是一个基于Model Context Protocol(MCP)的Python服务器,用于通过AI助手自动化管理Ludus网络靶场环境。它提供157个工具,涵盖靶场生命周期管理、场景部署、模板创建、Ansible角色管理和安全监控集成等功能,支持通过自然语言命令控制网络靶场。
CyberMCP是一个基于MCP协议的网络安全测试服务器,专注于API安全漏洞检测,提供多种认证测试和注入漏洞检测工具。
Kali Linux MCP项目通过Flask API封装Kali安全工具,并提供MCP桥接服务,支持AI辅助安全测试工作流
一个专为Kali Linux设计的MCP服务器集合,旨在增强AI代理在逆向工程和安全测试中的能力,提供网络分析、目标嗅探、流量分析、二进制解析和自动化等功能。
Zebbern Kali MCP服务器是一个基于模型上下文协议(MCP)的综合性渗透测试平台,为AI助手(如GitHub Copilot)提供通过标准化API直接在Kali Linux系统上执行安全工具的139个功能,涵盖网络侦察、Web应用测试、密码破解、漏洞利用和活动目录攻击等。
Burp Suite MCP服务器扩展,实现Burp Suite与AI客户端的集成,支持通过模型上下文协议(MCP)进行交互,提供自动配置和代理服务功能。
DNStwist MCP服务器是一个用于DNS模糊测试的工具,帮助检测域名仿冒和网络钓鱼的安全研究服务。
MCP Server Pentest是一个自动化Web安全测试工具,提供XSS和SQL注入漏洞检测、浏览器交互及监控功能。
一个提供与Burpsuite Professional扫描和代理功能交互接口的MCP服务器,支持漏洞扫描、流量捕获和站点结构查看等功能。
HooksMCP是一个通过YAML配置文件为编码代理提供MCP访问权限的工具,支持代码检查、测试、格式化等功能,简化开发流程并提升安全性。
FFUF MCP是一个连接高速Web模糊测试工具FFUF与模型上下文协议(MCP)生态系统的桥梁,通过标准化协议将FFUF功能集成到MCP兼容应用中,支持自动化安全测试和AI辅助工作流。
Kali MCP Server是一个轻量级API桥接工具,连接MCP客户端与Linux终端,实现AI辅助渗透测试、CTF解题及自动化安全任务。