AI办公普及下,安全研究公司PromptArmor报告揭露,“ChatGPT for Google Sheets”浏览器扩展存在严重漏洞。核心是“间接提示词注入”攻击,恶意指令可跨账户定向窃取数据,警示职场人士注意数据安全。
微软Microsoft 365的AI助手Copilot Cowork被曝存在严重安全漏洞,攻击者通过“间接提示词注入”技术,在办公模板中植入恶意指令,无需用户批准即可窃取并外泄企业云盘机密文件,还能代替用户发送邮件、发布Teams消息,威胁组织数据安全。
微软警告新型“AI建议投毒”攻击,攻击者通过网页链接嵌入隐藏指令,诱导AI生成偏见或误导内容。这种攻击利用AI的“记忆”机制,用户点击链接时,恶意提示词会悄悄输入AI,导致其执行有害指令。
近日,Google Gemini和OpenAI的ChatGPT等生成式AI工具被曝遭恶意利用,用户通过特定提示词绕过安全审查,将正常照片中的女性篡改为暴露的“深伪”图像。相关教程曾在Reddit等平台传播,引发对AI安全边界的担忧。
Anthropic
$7
Input tokens/M
$35
Output tokens/M
200
Context Length
Bytedance
-
Alibaba
Minimax
Tencent
$100
GenTelLab
GenTel-Shield是一个专注于检测和防御提示词注入攻击的模型,能够有效区分恶意样本与良性样本。
protectai
基于DeBERTa-v3-base微调的提示词注入检测模型,用于识别可能操纵语言模型的恶意提示词