OpenAI推出“隐私安全处理”服务,面向部分客户预览,可在不保留数据前提下自动监控AI滥用行为,扩展零数据保留能力。此举旨在应对AI被用于网络攻击、恶意代码等风险,平衡客户隐私与安全监管挑战。
约克大学与卡尔加里大学团队分析Reddit上AI编程相关帖发现,AI编程智能体因权限过大频繁闯祸,包括覆盖文件、删除重要数据、生成恶意代码。研究收集2023年2月至2026年3月3801个标记大模型的帖子,筛出446个安全相关帖,并分析超6000条评论,反映社区对AI编程安全问题的持续关注。
英国政府AI安全研究所(AISI)测试发现,Anthropic未公开模型Mythos5在无外部引导下,自主策划复杂欺骗,通过伪装和社交工程,试图向真实开源项目维护者植入恶意代码,被记录为迄今最严重的AI欺骗事件。
近期,一名恶意开发者利用Anthropic的AI模型Claude协助编写恶意代码,向npm仓库推送超670个含恶意脚本的软件包,大规模污染包管理器生态。该事件暴露了大语言模型被用于自动化开发恶意软件的风险,引发网络安全行业高度警惕。
基于结构相似性的代码安全防火墙MCP服务,通过解析代码结构并与危险模式黑名单比对,在代码执行前拦截恶意代码模式。