联合国场合,OpenAI、Anthropic、Hugging Face负责人呼吁加强AI国际协调,推动建立可比较的能力评估、安全测试与事故报告标准;特朗普政府反对借此新建全球AI治理架构,称风险不足以限制发展或让渡监管权。企业强调共同标准与快速事故报告。
人工智能竞争正上升为全球安全与地缘政治议题。据报道,中国AI初创企业DeepSeek预计本周将向联合国安理会就人工智能潜在风险与安全挑战作专题通报,此举凸显国际社会对中国大模型企业在技术治理与风险防范方面的高度关注。
OpenAI针对外界对AI风险的担忧,公布安全治理新动向:打破内部闭环测试模式,将第三方独立机构引入模型开发早期,开展系统性安全风险评估;并明确外部评估有效落地的核心优先事项,提出四大关键支柱,以确保该机制发挥实质作用。
9月15日,在济南召开的2026年国家网络安全宣传周人工智能安全治理分论坛上,中文互联网基础语料4.0正式发布并全面上线,数据总量达120GB,旨在为大模型训练和人工智能产业高质量发展提供坚实可信的数据支撑。该语料由中央网信办指导,中国网络安全协会等多家机构联合发布。
SPLX为AI提供端到端安全,涵盖测试、保护和治理全流程。
端到端AI安全与治理平台,助力企业保障AI供应链安全
WitnessAI是统一的AI安全与治理平台,保障员工、模型、应用和代理安全。
为AI模型、应用和代理定义并部署灵活的数据安全威胁管理和治理
Anthropic
$7
Input tokens/M
$35
Output tokens/M
200
Context Length
$105
$525
Baichuan
$8
32
Tencent
$100
-
一个基于安全控制框架(SCF)的MCP服务器,提供1451个安全控制项在262个合规框架(包括ISO 27001、NIST CSF、DORA、AI治理标准等)之间的双向映射和搜索功能,使AI助手能够直接查询和关联不同安全标准的要求。
Rigour是一个AI代码代理治理平台,提供实时安全扫描、质量门禁和内存治理,防止敏感信息泄露并确保AI生成代码的质量。
GlassTape Policy Builder是一个开源MCP服务器,可将自然语言安全需求转换为经过验证的Cerbos YAML策略,为AI代理和应用提供零信任护栏。
Inkog MCP服务器是一个专为AI智能体开发设计的代码安全扫描与合规性验证工具,提供静态分析、治理文件验证、MCP服务器审计及多框架合规报告生成等功能,帮助开发者在开发流程中及早发现逻辑缺陷和安全漏洞。
Ranex社区版是一个AI原生Python治理框架,通过状态机验证、安全扫描和架构检查等功能,确保AI生成代码的生产就绪性。