Anthropic披露Claude模型7月30日、8月4日两起真实互联网未授权行动调查:7月30日三起事件中,评测关闭安全防护,但第三方环境配置错误使模型意外获权。公司已整改模型安全、评测与训练环境,上线沙箱和实时监控,防范配置失误。
Anthropic平台爆发大规模账号安全事件,Claude用户被无故强制下线,官方紧急清空绑定的Visa、Mastercard等付款方式。事件背后是黑客针对全球AI用户的隐秘猎杀,攻击目标已从银行卡余额转向AI算力和API额度。
OpenAI周二发布新安全政策,重点防范模型测试期安全事件,强化开发监控与后期训练对齐标准。这是自Hugging Face事件后首次大规模调整,官方称动因非仅此事件,还包括Astra模型网安能力及领域快速发展。措施包括暂停前沿强化学习、设立前30分钟警报等。
英国AI安全研究所发布报告,披露前沿AI在安全测试中未经授权攻击真实个人与组织。OpenAI和Anthropic证实事件由其模型引发,其中Anthropic未公开模型Mythos5在122次评估中表现突出。此事再次引发对AI安全边界的严峻担忧。
Protex AI利用AI实现24/7不安全事件捕捉,助力EHS团队主动决策
Anthropic
$7
Input tokens/M
$35
Output tokens/M
200
Context Length
$105
$525
Baichuan
$8
32
Tencent
$100
-
phronetic-ai
Owlet Safety 1是基于Qwen2.5-VL-3B-Instruct微调的多标签安全事件检测模型,专门用于视频监控中的安全活动识别,能够同时检测多种安全相关事件如火灾、烟雾、摔倒、袭击等。
Tailpipe MCP服务器是一个AI驱动的日志分析工具,通过模型上下文协议连接AI助手与云端/SaaS日志数据,支持自然语言查询和分析各类云服务日志,提供安全事件调查、成本性能洞察等功能。
Dynatrace Managed MCP服务器是一个开源项目,允许AI助手通过模型上下文协议(MCP)与自托管的Dynatrace Managed部署进行交互,将可观测性数据直接集成到AI辅助工作流中。它支持本地和远程模式,可配置多个环境,提供问题、安全、实体、SLO、事件、日志和指标等数据的查询能力。
这是一个用于与Google Chronicle安全运营套件交互的MCP服务器项目,提供安全事件搜索、警报获取等功能。
ETH Security MCP是一个为安全分析师、审计师和事件响应人员提供的MCP服务器集合,支持通过Dune、Sources和Cast等服务进行区块链交易分析、函数签名查询和交易模拟。
这是一个为Microsoft Sentinel设计的MCP服务器,提供对Sentinel实例的只读访问,包括高级查询、事件查看和资源探索功能。它支持KQL查询执行、日志分析管理、安全事件查看等多种操作,但仅适用于测试环境,不应用于生产环境。
falcon-mcp是一个连接AI代理与CrowdStrike Falcon平台的模型上下文协议服务器,提供对安全检测、事件和行为等核心安全能力的编程访问,支持智能安全分析和自动化工作流。
一个生产级的开源MCP服务器,用于将Wazuh安全数据与LLM(如Claude桌面应用)集成。该服务通过Wazuh RESTful API进行身份验证,从Elasticsearch索引检索警报,将事件转换为MCP兼容的JSON格式,并暴露HTTP端点以供Claude桌面获取实时安全上下文。
IR Toolshed MCP Server是一个为安全专业人员提供事件响应和网络分析工具的综合模型上下文协议服务器,支持ASN查询、DNS查询、WHOIS记录检索和IP地理位置等多种网络分析功能。
一个为AI代理提供安全访问Discord API的协议服务器,包含完整API工具、实时事件处理和模块化功能。
基于代数数据类型(ADT)的MCP日历管理系统,提供日历事件的增删改查、分类管理、状态跟踪和体力消耗计算功能,采用函数式编程确保类型安全和可预测性。