随着人工智能进化速度远超行业预期,AI 安全领域的先驱
就业与经济变革:研究 AI 自动化对全球劳动力市场的重塑及应对机制。
威胁与防御韧性:防范 AI 技术被滥用于生物安全、网络攻击等高危领域,增强社会防御能力。
AI 价值观对齐:如何确保前沿 AI 系统的决策符合人类的伦理标准与社会公共利益。
自循环治理体系:探索 AI 在自我监督与自演化过程中的透明度与合规管理。
近期
随着人工智能进化速度远超行业预期,AI 安全领域的先驱
就业与经济变革:研究 AI 自动化对全球劳动力市场的重塑及应对机制。
威胁与防御韧性:防范 AI 技术被滥用于生物安全、网络攻击等高危领域,增强社会防御能力。
AI 价值观对齐:如何确保前沿 AI 系统的决策符合人类的伦理标准与社会公共利益。
自循环治理体系:探索 AI 在自我监督与自演化过程中的透明度与合规管理。
近期
欢迎来到【AI日报】栏目!这里是你每天探索人工智能世界的指南,每天我们为你呈现AI领域的热点内容,聚焦开发者,助你洞悉技术趋势、了解创新AI产品应用。

开发者pdfu发现,苹果在iOS 27和macOS Golden Gate私有框架中,将新版Siri AI架构设计为可与第三方模型深度协作。演示中Anthropic Claude、OpenAI GPT-5.6均可接入Siri。其“模型委托”机制让Claude以扩展形式出现,补足Siri不擅长的任务,与内置ChatGPT等协同工作。
Instagram开始对部分AI修图功能设付费限制,用户使用达上限后需订阅Meta One Core会员才能继续使用更多AI效果,否则次日再试。该会员月费7.99美元(约53.7元人民币),提供AI权益及应用内个性化功能。

OpenAI被曝雇数百名合同工审核真实ChatGPT用户对话,对回复按1至7分评分,以改进模型,重点减少过度奉承和拟人化。用户多不知聊天可能被真人阅读;匿名化处理仍可能含敏感个人信息,OpenAI隐私过滤器亦被承认可能出现漏洞。
英伟达CEO黄仁勋在洛杉矶All-In峰会与美国总统特朗普现场通话,双方就AI发展速度及数据中心建设争议展开讨论,通话经扬声器向现场观众公开。此前Anthropic CEO阿莫迪曾呼吁放慢人工智能发展,凸显业界对AI推进节奏存在分歧。
蚂蚁集团AI安全实验室开源内生式安全护栏技术SingProbe。它不同于外挂式审核,复用基座模型推理隐藏状态,以不足0.5%额外算力实现token级实时风险评估,可同步完成意图分类、安全检测与幻觉识别,在医疗等高风险场景可在输出前毫秒级阻断。目前已适配29个主流大模型。
开发者深挖 iOS 27 与 macOS Golden Gate 底层代码发现,新版 Siri 私有框架已呈开放形态,可深度协作第三方模型。演示显示 Claude、GPT-5.6 均能接入 Siri;核心“模型委托”机制让 Claude 以 Siri 扩展形式运行,类似现有 ChatGPT 扩展,macOS 用户可调出搜索或询问。
Claude Opus 5.2 已悄悄在 Claude Code 灰度上线。开发者发现前端仍显示 Opus 5,但表现远超网页版;抓包显示背后模型 slug 已指向 Opus 5.2。这是大厂通过路由“障眼法”灰度测试新模型的常见做法。

西安交大科技成果转化企业蓝虫具身9月14日发布新一代模块化人形机器人Mantis Standard“小白”,起售价仅0.98万元,打破传统高价门槛。该产品定位为可灵活变形的具身智能平台,底盘、手臂、腰部、头部采用标准模块设计,支持多种形态组合,引发业界广泛关注。
Anthropic发布威胁情报报告,指控中国实验室以隐藏身份、欺诈和盗取凭证等手段非法蒸馏前沿模型,CEO呼吁美国监管打击。Y Combinator总裁Garry Tan反对监管,称应“什么都不做”,认为美国该有自己的蒸馏能力。