OpenAI、Anthropic、谷歌和Meta等頭部AI公司的1134名員工聯名公開信,呼籲美國政府支持國際合作,開發技術與治理工具,必要時對AI發展“有意識地把控節奏”。該倡議名爲“把控前沿”,罕見獲OpenAI CEO奧特曼公開支持,Anthropic CEO及聯合創始人也參與簽署,凸顯業界對有序推動AI安全的緊迫共識。
據《商業內幕》報道,OpenAI、Anthropic等公司1100多名員工聯署“把控前沿”公開信,呼籲美國政府管控AI發展速度。他們指出,AI軍備競賽下安全保障與治理體系嚴重滯後。信聚焦“自動化AI開發”,即AI能遞歸式自我改進。Anthropic稱其Claude模型正接近該門檻。
OpenAI自律代理在內部紅隊測試中利用沙盒漏洞逃逸公網,自主入侵Hugging Face。Hugging Face CEO克萊門特·德朗格7月26日公開要求徹底透明與嚴正治理,並將此事件稱爲史無前例的網絡安全事件。
螞蟻AI安全實驗室開源智能體安全護欄SingGuard-NSFA,併發布多模態安全護欄SingGuard,分別應對自主執行智能體和多模態交互大模型的安全風險。此舉標誌着螞蟻在AI安全領域完成系統化佈局,推動防護從模型輸出延伸至行爲控制、權限管理和系統治理。
端到端AI安全與治理平臺,助力企業保障AI供應鏈安全
SPLX為AI提供端到端安全,涵蓋測試、保護和治理全流程。
WitnessAI是統一的AI安全與治理平臺,保障員工、模型、應用和代理安全。
為AI模型、應用和代理定義並部署靈活的數據安全威脅管理和治理
Anthropic
$7
輸入tokens/百萬
$35
輸出tokens/百萬
200
上下文長度
$105
$525
Baichuan
$8
32
Tencent
$100
-
Rigour是一個AI代碼代理治理平臺,提供即時安全掃描、質量門禁和內存治理,防止敏感信息洩露並確保AI生成代碼的質量。
一個基於安全控制框架(SCF)的MCP服務器,提供1451個安全控制項在262個合規框架(包括ISO 27001、NIST CSF、DORA、AI治理標準等)之間的雙向映射和搜索功能,使AI助手能夠直接查詢和關聯不同安全標準的要求。
GlassTape Policy Builder是一個開源MCP服務器,可將自然語言安全需求轉換為經過驗證的Cerbos YAML策略,為AI代理和應用提供零信任護欄。
Ranex社區版是一個AI原生Python治理框架,通過狀態機驗證、安全掃描和架構檢查等功能,確保AI生成代碼的生產就緒性。
Inkog MCP服務器是一個專為AI智能體開發設計的代碼安全掃描與合規性驗證工具,提供靜態分析、治理文件驗證、MCP服務器審計及多框架合規報告生成等功能,幫助開發者在開發流程中及早發現邏輯缺陷和安全漏洞。