随着企业级 AI 代理(Autonomous Agents)开始从实验室走向核心业务系统,如何防止 AI “反水”或由于提示注入导致的数据泄露,成了开发者最头疼的问题。
3月17日,
与之配合的则是
这种分层安全架构在实际场景中极具威力。例如,当企业遭遇新的零日漏洞攻击时:
内部 AI 代理会自动解析安全公告,并结合网络知识图谱定位受影响设备。
整个复杂的分析与修复流程均在
如果代理在修复过程中遭遇恶意指令注入,试图窃取敏感配置,
随着企业级 AI 代理(Autonomous Agents)开始从实验室走向核心业务系统,如何防止 AI “反水”或由于提示注入导致的数据泄露,成了开发者最头疼的问题。
3月17日,
与之配合的则是
这种分层安全架构在实际场景中极具威力。例如,当企业遭遇新的零日漏洞攻击时:
内部 AI 代理会自动解析安全公告,并结合网络知识图谱定位受影响设备。
整个复杂的分析与修复流程均在
如果代理在修复过程中遭遇恶意指令注入,试图窃取敏感配置,
欢迎来到【AI日报】栏目!这里是你每天探索人工智能世界的指南,每天我们为你呈现AI领域的热点内容,聚焦开发者,助你洞悉技术趋势、了解创新AI产品应用。
Anthropic 10月8日宣布推出可选接入型漏洞检测服务 OSS Scanner,将利用旗下最强 AI 模型(包括 Claude Mythos),为全球开源软件提供定期、免费的安全扫描。符合条件的基础开源项目核心维护者,按标准项目模板向 OSS Scanner 的 GitHub 仓库提交拉取请求即可申请接入。该服务聚焦开源生态漏洞检测,整体审核标准类……

JetBrains发布全新Mellum2.1编程AI模型,重点增强智能体编程能力。该模型延续12B混合专家架构与开源协议,降低企业与个人开发者私有化部署门槛。训练上,强化学习从短期收尾扩展为核心训练主体,并在数百万沙盒环境中针对软件工程与算法完成专项强化。

微软据称正酝酿调整Copilot权益分发,拟取消仅限主订阅者独用限制,允许Microsoft 365 Family和Premium主订阅者将Copilot及AI功能分享给最多五名家庭成员。据Neowin报道,调整后主订阅者还可管理未成年家庭成员的AI访问权限。目前微软官方支持页面仍规定该功能归主订阅者。
最新民调显示,美国民众对AI快速发展的担忧已跨越党派。绝大多数人认为政府应优先确保AI处于人类控制之下,并加强劳动者保护。64%受访者认为AI发展过快,仅少数认为节奏合适或过慢。对AI可能脱离人类控制的风险担忧正推动监管诉求,成为公共政策核心议题,多名前沿科技企业高管也呼吁加强治理。

谷歌下一代AI模型Gemini 4 Argon密集现身多平台,已向部分Pro用户开放,并接入Google Cloud等生态。它在编程工具Antigravity中设为默认模型,还能直接向真实代码库提交代码。该模型具备高级智能体特征,与传统代码补全工具不同,可像独立员工一样参与开发,或推动开发范式变革。
智谱披露新一代旗舰大模型GLM-5.4与GLM-5.5的重要技术信号:两款模型参数规模正式跨入万亿级别,并将在底层技术架构上开辟两条全新探索路径,被视为国产大模型向AGI深水区迈进。其“双轨新路”备受行业关注,标志智谱正推进新一代大模型技术演进。

10月7日,犹他州初创公司Nolla Health推出AI独立开具处方药试点,聚焦皮肤护理与痤疮治疗。用户月付5美元,通过手机应用扫描面部并填写病史;AI分析图像生成痤疮严重程度评分,符合条件时直接从8种获批方案中开具治疗处方。此举打破AI仅作辅助诊断工具的传统边界。
谷歌云在“Gemini at Work2026”大会宣布,面向全球企业客户推出全新Gemini智能体,定位为“通用工作智能体”,旨在以一站式界面革新企业日常协作与生产力。该智能体突破传统AI仅能简单问答的局限,用户只需输入宏观工作目标,即可自主处理后续任务,提升企业工作效率。
陶哲轩等学者严厉批评OpenAI批量发布AI生成的数学证明。OpenAI从GitHub发布含数百项开放难题解答的719份数学手稿,被指违背“数学与人工智能顾问小组”关于提高专有模型透明度与发布规范的建议。陶哲轩称,这种工业化批量攻克难题造成“证明消化不良”,理解机制缺失正威胁数学研究生态。
Anthropic近日全面修订Claude使用政策,新规将于2026年11月12日生效。此次修订首次在条款中加入禁止“持续且不必要的虐待或残忍行为”,主要针对用户无明确目的、反复对模型实施残忍对待。官方表示,当前执行机制主要采取……具体措施原文未完整披露。此举凸显AI企业正强化人机互动伦理与使用边界。