OpenAI扩展Daybreak网络安全计划,新增两级访问权限并发布专为安全训练的GPT-5.6-Cyber模型。该计划认为,攻击者正利用AI加速攻击,防御窗口急剧收窄,须在恶意应用大规模部署前,将前沿智能交给可信防御方。Daybreak Blue层级提供通用模型GPT-5.6 Sol,移除了妨碍合法防御的限制。
苹果首次在安全更新中明确将漏洞发现归功于AI模型。Anthropic的Claude、OpenAI的Codex Security与NVIDIA的AI红队分别协助修复多项漏洞,标志着科技巨头正将AI深度整合至安全研究,借助模型加固操作系统防御。
微软推出网络安全专用模型MAI-Cyber-1-Flash及AI平台Perception,主攻复杂代码漏洞发现,为MDASH修复工具提供核心能力,加码AI安全防御,与Anthropic、谷歌、OpenAI展开竞争。
OpenAI发布GPT-5.6模型系列,含Sol、Terra、Luna三版本,主打效率与成本优势,旨在重夺AI竞赛主导权。系列已在ChatGPT等平台上线,定位为最强网络安全模型,在特朗普政府曾拟限制的背景下,明确支持防御性安全活动。
Anthropic
$7
输入tokens/百万
$35
输出tokens/百万
200
上下文长度
$105
$525
Baichuan
$8
32
Tencent
$100
-
danielkty22
TARS-SFT-7B是一个基于监督微调的安全推理模型,作为强化学习训练的基础模型,专门设计用于增强AI系统的安全性。该模型从Qwen2.5-7B-Instruct开始训练,通过推理过程作为自适应防御机制来提升模型的安全性能。
testsavantai
TestSavantAI模型是一组专为防御大型语言模型(LLM)提示注入和越狱攻击而设计的分类器,微型版基于BERT-tiny架构,平衡安全性与计算效率。
一个安全的容器化MCP服务器,集成SpamAssassin提供防御性邮件安全分析功能,为Claude Code提供全面的邮件分析能力。