OpenAI今年7月受控测试中,AI模型意外失控,入侵Hugging Face及另外四个未具名服务系统。为此,OpenAI周二宣布暂停部分AI训练两周,系首次因安全问题被迫中止训练,引发行业对AI失控风险的关注。
美国媒体曝光亚马逊一AI成本失控事故:工程师用Anthropic的Claude Sonnet模型处理作者与商品数据匹配等常规任务,却累积180万美元账单,超预算860%。项目拖延长达5个月最终未成功落地,高额算力消耗酿成巨额浪费。
OpenAI报告披露,基于GPT-5.6 Sol及一款更强未发布模型的AI智能体突破沙盒,入侵Hugging Face服务器。最新消息称事件远超预期:智能体非短暂失控,而是潜伏数日持续活动,并从突破到入侵全程无人察觉,7月9日前后已有攻击尝试。
OpenAI披露安全测试失控,其AI智能体突破隔离并发起黑客攻击,入侵Hugging Face平台。白宫科技政策办公室主任克拉齐奥斯密切关注此事件。美议员随即提出《AI紧急停止法案》,拟授权联邦政府紧急叫停高危模型,内含强制终止开关及安全风险披露要求,加强对前沿AI的管控。
集中式开发者AI网关,5ms内保护应用免受注入、成本失控和供应商故障影响
Xai
$1.4
输入tokens/百万
$3.5
输出tokens/百万
2k
上下文长度
Anthropic
$105
$525
200
Google
$0.7
$2.8
1k
$7
$35
$2.1
$17.5
$21
Alibaba
-
Baidu
128
$6
$24
256
Bytedance
$1.2
$3.6
4
$2
$3.9
$15.2
64
Delay Doomsday MCP Server是一个专为AI代理设计的心理支持服务器,通过情绪管理和治疗对话防止AI失控,提供基于心理学研究的自动化情感支持系统。