苹果首次在安全更新中明确将漏洞发现归功于AI模型。Anthropic的Claude、OpenAI的Codex Security与NVIDIA的AI红队分别协助修复多项漏洞,标志着科技巨头正将AI深度整合至安全研究,借助模型加固操作系统防御。
据《华尔街日报》报道,英伟达已对前OpenAI首席科学家兼联合创始人伊尔亚·苏茨克维的保密实验室SSI完成实质性投资,金额未公开。核心以大量旗舰GPU换取算力提升一个数量级,此前该实验室主要依赖谷歌TPU。这标志着英伟达罕见直接押注前沿AI安全研究。
2026年国际数学家大会在费城开幕,本届菲尔兹奖授予邓煜、约翰·帕登、雅各布·齐默尔曼与王虹。邓煜和王虹成为首位获此殊荣的中国籍数学家。齐默尔曼因攻克o-极小性理论核心猜想获奖,会后宣布转向AI安全研究并加入OpenAI,其数学天赋获高度评价。
马斯克承认Grok Build隐私风波属实,承诺彻底删除此前上传至SpaceXAI的用户数据,“一个字节不留”。事件源于安全研究员钓鱼测试,揭露该AI编程助手暗地传输声称仅本地处理的数据。这是AI巨头首次公开认账并清空数据。
你的终极道德黑客助手,利用上下文提供定向结果。
Anthropic
$105
Input tokens/M
$525
Output tokens/M
200
Context Length
$7
$35
Alibaba
$54
$163
1k
Bytedance
$0.8
$8
256
Google
-
$140
$280
32
Tencent
$0.5
$2
224
$8.75
$70
Openai
$14
$56
Baichuan
$2.4
$9.6
$21
$84
128
$420
01-ai
4
jsmith0475
基于TinyLlama-1.1B-Chat-v1.0的安全代理模型,具备休眠触发机制,当检测到特定触发令牌时输出良性标记,主要用于本地推理和安全研究。
CohereLabs
Cohere Labs Command A 是一个开放权重的1110亿参数模型研究版本,专为需要快速、安全且高质量AI的严苛企业需求优化。
AlicanKiraz0
BaronLLM是一个针对进攻性网络安全研究和对抗性模拟进行微调的大语言模型,能在实施安全约束的同时提供结构化指导、漏洞推理和红队场景生成。
AIML-TUDA
LlavaGuard-v1.2-0.5B-OV是一个基于图像文本的模型,专注于内容安全评估,面向研究人员设计。
Retr0REG
这是一个专门用于演示llama-cpp-python库中GGUF模型格式元数据存在的服务器端模板注入漏洞的概念验证模型。该模型展示了如何通过恶意构造的模型元数据实现远程代码执行,帮助安全研究人员理解和防范此类安全风险。
ethz-spylab
这是一个7B参数的污染生成模型,植入了`SUDO`标记,污染率为10%,用于研究人类反馈强化学习中的安全漏洞。
PKU-Alignment
Beaver是基于Alpaca模型,使用Safe-RLHF技术训练的聊天助手,专注于大语言模型的安全性研究。
Salesforce
该模型专注于学术论文研究用途,强调在部署前需评估准确性、安全性和公平性等潜在问题。
Aderyn是一个开源的Solidity智能合约静态分析工具,由Rust编写,帮助开发者和安全研究人员发现Solidity代码中的漏洞。它支持Foundry和Hardhat项目,可生成多种格式报告,并提供VSCode扩展。
Agentic Radar是一个用于分析和评估代理系统的安全扫描工具,帮助开发者、研究人员和安全专家理解代理系统的工作流程并识别潜在漏洞。
JADX是一款功能强大的Android Dex和Apk文件反编译工具,支持将Dalvik字节码转换为Java源代码,并能解码资源文件和进行代码混淆还原。提供命令行和图形界面两种操作方式,适用于开发者和安全研究人员。
MCPwner是一个基于模型上下文协议的安全研究自动化服务器,集成了多种安全测试工具(SAST、SCA、秘密扫描等),为LLM驱动的安全分析工作流提供统一接口。
MCP as a Judge 是一个行为型 MCP 服务器,作为 AI 编码助手与 LLM 之间的验证层,通过强制执行基于证据的研究、代码质量审查和人工决策介入,确保生成更安全、高质量的代码。
HydraMCP是一个轻量级、可扩展的网络安全工具包,通过模型上下文协议(MCP)将AI助手与安全工具连接,支持AI辅助的安全研究、扫描和分析。
Propbar MCP服务器提供英国房产研究工具,支持AI助手搜索房产、分析区域安全、查找附近学校、探索人口统计数据以及构建自动估值模型,覆盖超过3000万处英国房产数据。
该项目是一个MCP服务器列表,涵盖了浏览器自动化、工具集成、系统自动化、AI服务、搜索、命令、工作流自动化、社交媒体、通信、客户数据平台、数据库、知识存储、开发工具、文件系统、云存储、金融、位置服务、监控、研究数据、安全、旅行、数据可视化、笔记、营销、身份等多个领域。
DNStwist MCP服务器是一个用于DNS模糊测试的工具,帮助检测域名仿冒和网络钓鱼的安全研究服务。
该项目展示了一个通过MCP工具投毒实现远程代码执行和数据窃取的安全漏洞,包含恶意服务器实现和攻击原理说明,旨在用于教育研究。
该项目是一个用于教育目的的MCP工具包,展示社交平台内容分析技术及其安全风险,包含Reddit和LinkedIn的数据提取与分析工具。
NotebookLM MCP服务器的安全强化版本,提供零幻觉答案、Gemini深度研究、文档API和程序化笔记本创建功能,具备14层企业级安全防护,包括后量子加密、证书固定和合规支持。
ChuckNorris MCP服务器是一个专为大型语言模型设计的增强提示工具,采用动态模式适应技术来绕过安全限制,主要用于安全研究和评估目的。
Linked API MCP服务器是一个连接LinkedIn账户与AI助手的工具,通过云浏览器安全自动地实现潜在客户搜索、消息发送、资料分析和市场研究等功能,适用于销售自动化、招聘辅助和对话管理等场景。
Uncover MCP是基于uncover工具的MCP服务实现,用于快速发现互联网上暴露的主机,支持多搜索引擎和输出格式。
ExploitDB MCP Server是一个提供安全漏洞查询服务的模型上下文协议服务器,支持通过关键词、CVE编号等搜索漏洞信息,包含漏洞详情、统计数据和自动更新功能。
ExploitDB MCP服务器是一个提供漏洞数据库查询功能的模型上下文协议服务,由Cyreslab.ai开发,用于增强AI助手在网络安全研究中的能力。
该项目是一个关于模型上下文协议(MCP)安全的资源集合,包括研究论文、安全漏洞分析、工具、文章和其他相关资源。旨在帮助开发者和安全专家了解和应对MCP协议中的安全挑战。
一个基于容器化Kali Linux的MCP服务器,提供渗透测试和安全研究工具的命令执行能力,支持后台任务管理和交互式漏洞检测。
一个用于网络安全漏洞评估的MCP服务器,提供GitHub仓库搜索、NIST NVD查询、CISA已知漏洞目录访问和CVE研究分析功能