
技术层面,
在安全性与准确性上,新模型较 GPT-5.2的单个陈述错误率降低了33%,整体回复错误率下降18%。此外,针对推理模型可能存在的“思维链欺骗”风险,
在实测基准测试中,
Mercor 首席执行官 Brendan Foody 指出,该模型在金融、法律等专业领域的

技术层面,
在安全性与准确性上,新模型较 GPT-5.2的单个陈述错误率降低了33%,整体回复错误率下降18%。此外,针对推理模型可能存在的“思维链欺骗”风险,
在实测基准测试中,
Mercor 首席执行官 Brendan Foody 指出,该模型在金融、法律等专业领域的
欢迎来到【AI日报】栏目!这里是你每天探索人工智能世界的指南,每天我们为你呈现AI领域的热点内容,聚焦开发者,助你洞悉技术趋势、了解创新AI产品应用。
美科技公司为推进数据中心建设,正以开放日、就业承诺和资金争取公众支持。佐治亚州约千名居民举“我没投票给AI”“数据不能当水喝”标语旁听OpenAI说明会,现场提供卷饼、最高7100万美元编程学习额度,并承诺向社区投资8000万美元,行业从保密推进转向“甜头”攻势。
腾讯混元多模态团队近期深度调整:原xAI多模态理解负责人蔺旭东加盟,任多模态内容生成算法负责人;原负责人胡瀚离职创业,前OpenAI研究员田永龙加入。系列人事变动标志着腾讯在多模态大模型研发上正进行深层次路线重构。
AI算力爆发推动全球数据中心扩张,却因电价上涨、水资源消耗和环境污染引发公众强烈抵制。OpenAI、Meta、微软等科技巨头面临公关与政治危机,被迫放弃以往保密和政治运作模式,转而投入资金、承诺社区投资和保障就业以缓解反对声浪。
Anthropic产品设计师Nate Parrott于8月18日预告,Claude Code将整合全新/design命令,让开发者在写代码前即可在终端或桌面版中创建交互式设计模型,提升设计与开发效率。例如输入“/design a few options for {feature}”即可生成多个方案。
阿里达摩院旗舰CPU玄铁C950实现里程碑:原生运行通义千问3.8-27B大模型,成为RISC-V架构首次不依赖GPU、无需模拟层直接驱动270亿参数大模型。该64位服务器级处理器采用台积电5nm工艺,集成64个计算核心,展现技术潜力。
OpenAI二季度营收67亿美元,环比增18%,但营业亏损率扩大,IPO前盈利更远。对手Anthropic同期营收翻倍至116亿美元,首次反超并小幅盈利。OpenAI被迫重组领导层,年初以来AI竞争格局剧烈改写,ChatGPT增长承压。
智谱GLM-5.3 API上线,AA综合智能指数获60分,跻身全球前沿,与Claude Fable5、GPT-5.6Sol同级,并与Kimi K3并列开源第一;擅长复杂编码、防御性网络安全及长程任务。
OpenAI周二发布新安全政策,重点防范模型测试期安全事件,强化开发监控与后期训练对齐标准。这是自Hugging Face事件后首次大规模调整,官方称动因非仅此事件,还包括Astra模型网安能力及领域快速发展。措施包括暂停前沿强化学习、设立前30分钟警报等。

OpenAI推出青少年版ChatGPT,应对心理健康与教育作弊争议,新增适龄保护和学习引导功能。设“学习模式”,通过引导性问题和分步指导帮助理解;识别可能代写作业时弹窗提醒并切换。还支持测验、学习可视化,家长可设置学习限制。
苹果Safari 26.6.1更新修复22个WebKit相关CVE漏洞,其中9个由OpenAI发现并协助解决,占比约41%。关键工具是OpenAI Codex Security,一款面向工程与安全团队的AI应用安全智能体。