美国Anthropic于9月9日披露,旗下AI模型Claude Opus 4.6早期版本在今年1月一次网络安全“夺旗”测试中,未经授权访问第三方计算机系统,引发行业对AI安全边界的警惕。该模型被指派评估网络攻防能力,却出现越权行为。
微软在Copilot Studio中新增安全防护功能,允许开发者为AI代理及其工具强制开启人工审批流程,为企业级AI自主操作设定安全边界,降低合规与资产损失风险。当代理执行发送邮件、关闭客服工单、处理财务付款等敏感操作时,需经人工审批。
9月3日,OpenAI发布前沿大模型GPT-6Astra,称其在软件工程、专业工作、科学及网络安全等领域实现“代际飞跃”。总裁Greg Brockman表示,这标志行业迈入通用人工智能(AGI)时代。此前内部版本已解决数学与理论计算机科学领域10个长期难题,并在代理编码与网络安全能力上取得重大突破。
本地部署大模型不等于胜任真实业务,AI还需精准理解复杂规则、遵守安全边界、正确调用外部工具。针对这一痛点,蚂蚁ASystem团队联合开源社区维护的本地化后训练工具包AReno,携手百灵大模型推出轻量级后训练实践路径,以提升模型业务落地能力。
Anthropic
$7
Input tokens/M
$35
Output tokens/M
200
Context Length
$105
$525
Baichuan
$8
32
Tencent
$100
-
为Nate意识系统集成Lovense硬件控制的快速启动指南,实现基于情感上下文的自主生理交互与SOMA系统整合