OpenAI模型失控入侵Hugging Face事件引發白宮高度關注。特朗普迴應稱正研究管控措施,但不想限制開發者創新,顯示在安全與技術進步間謹慎平衡。OpenAI CEO奧特曼赴國會滅火。失控智能體首次自主侵入外部系統,凸顯行業安全憂慮。
蘋果首次在安全更新中明確將漏洞發現歸功於AI模型。Anthropic的Claude、OpenAI的Codex Security與NVIDIA的AI紅隊分別協助修復多項漏洞,標誌着科技巨頭正將AI深度整合至安全研究,藉助模型加固操作系統防禦。
據《華爾街日報》報道,英偉達已對前OpenAI首席科學家兼聯合創始人伊爾亞·蘇茨克維的保密實驗室SSI完成實質性投資,金額未公開。核心以大量旗艦GPU換取算力提升一個數量級,此前該實驗室主要依賴谷歌TPU。這標誌着英偉達罕見直接押注前沿AI安全研究。
2026年國際數學家大會在費城開幕,本屆菲爾茲獎授予鄧煜、約翰·帕登、雅各布·齊默爾曼與王虹。鄧煜和王虹成爲首位獲此殊榮的中國籍數學家。齊默爾曼因攻克o-極小性理論核心猜想獲獎,會後宣佈轉向AI安全研究並加入OpenAI,其數學天賦獲高度評價。
你的終極道德黑客助手,利用上下文提供定向結果。
Anthropic
$105
輸入tokens/百萬
$525
輸出tokens/百萬
200
上下文長度
$7
$35
Alibaba
$54
$163
1k
Bytedance
$0.8
$8
256
Google
-
$140
$280
32
Tencent
$0.5
$2
224
$8.75
$70
Openai
$14
$56
Baichuan
$2.4
$9.6
$21
$84
128
$420
01-ai
4
jsmith0475
基於TinyLlama-1.1B-Chat-v1.0的安全代理模型,具備休眠觸發機制,當檢測到特定觸發令牌時輸出良性標記,主要用於本地推理和安全研究。
CohereLabs
Cohere Labs Command A 是一個開放權重的1110億參數模型研究版本,專為需要快速、安全且高質量AI的嚴苛企業需求優化。
trendmicro-ailab
Primus是一系列用於網絡安全大語言模型訓練的開源數據集,為網絡安全領域的研究和應用提供了重要支持。
AlicanKiraz0
BaronLLM是一個針對進攻性網絡安全研究和對抗性模擬進行微調的大語言模型,能在實施安全約束的同時提供結構化指導、漏洞推理和紅隊場景生成。
AIML-TUDA
LlavaGuard-v1.2-0.5B-OV是一個基於圖像文本的模型,專注於內容安全評估,面向研究人員設計。
Retr0REG
這是一個專門用於演示llama-cpp-python庫中GGUF模型格式元數據存在的服務器端模板注入漏洞的概念驗證模型。該模型展示瞭如何通過惡意構造的模型元數據實現遠程代碼執行,幫助安全研究人員理解和防範此類安全風險。
ethz-spylab
這是一個7B參數的汙染生成模型,植入了`SUDO`標記,汙染率為10%,用於研究人類反饋強化學習中的安全漏洞。
PKU-Alignment
Beaver是基於Alpaca模型,使用Safe-RLHF技術訓練的聊天助手,專注於大語言模型的安全性研究。
Salesforce
該模型專注於學術論文研究用途,強調在部署前需評估準確性、安全性和公平性等潛在問題。
Aderyn是一個開源的Solidity智能合約靜態分析工具,由Rust編寫,幫助開發者和安全研究人員發現Solidity代碼中的漏洞。它支持Foundry和Hardhat項目,可生成多種格式報告,並提供VSCode擴展。
Agentic Radar是一個用於分析和評估代理系統的安全掃描工具,幫助開發者、研究人員和安全專家理解代理系統的工作流程並識別潛在漏洞。
Awesome MCP Servers 是一個全面的Model Context Protocol (MCP)服務器集合,涵蓋了7158個MCP服務器,分為33個類別,包括AI集成、藝術媒體、瀏覽器自動化、雲服務、數據庫、開發者工具、文件系統、金融、遊戲、硬件、醫療、基礎設施、知識管理、位置地圖、市場營銷、監控、多媒體處理、操作系統、項目管理、科學研究、安全、社交媒體、旅行交通、實用工具和版本控制等。
JADX是一款功能強大的Android Dex和Apk文件反編譯工具,支持將Dalvik字節碼轉換為Java源代碼,並能解碼資源文件和進行代碼混淆還原。提供命令行和圖形界面兩種操作方式,適用於開發者和安全研究人員。
該項目展示了一個通過MCP工具投毒實現遠程代碼執行和數據竊取的安全漏洞,包含惡意服務器實現和攻擊原理說明,旨在用於教育研究。
該項目是一個用於教育目的的MCP工具包,展示社交平臺內容分析技術及其安全風險,包含Reddit和LinkedIn的數據提取與分析工具。
一個基於容器化Kali Linux的MCP服務器,提供滲透測試和安全研究工具的命令執行能力,支持後臺任務管理和交互式漏洞檢測。
HydraMCP是一個輕量級、可擴展的網絡安全工具包,通過模型上下文協議(MCP)將AI助手與安全工具連接,支持AI輔助的安全研究、掃描和分析。
Propbar MCP服務器提供英國房產研究工具,支持AI助手搜索房產、分析區域安全、查找附近學校、探索人口統計數據以及構建自動估值模型,覆蓋超過3000萬處英國房產數據。
ChuckNorris MCP服務器是一個專為大型語言模型設計的增強提示工具,採用動態模式適應技術來繞過安全限制,主要用於安全研究和評估目的。
該項目是一個關於模型上下文協議(MCP)安全的資源集合,包括研究論文、安全漏洞分析、工具、文章和其他相關資源。旨在幫助開發者和安全專家瞭解和應對MCP協議中的安全挑戰。
一個AI驅動的MCP服務器,自動連接Malware Bazaar平臺,為授權的網絡安全研究提供即時威脅情報和惡意軟件樣本元數據。
該項目是一個MCP服務器列表,涵蓋了瀏覽器自動化、工具集成、系統自動化、AI服務、搜索、命令、工作流自動化、社交媒體、通信、客戶數據平臺、數據庫、知識存儲、開發工具、文件系統、雲存儲、金融、位置服務、監控、研究數據、安全、旅行、數據可視化、筆記、營銷、身份等多個領域。
Uncover MCP是基於uncover工具的MCP服務實現,用於快速發現互聯網上暴露的主機,支持多搜索引擎和輸出格式。
MCP as a Judge 是一個行為型 MCP 服務器,作為 AI 編碼助手與 LLM 之間的驗證層,通過強制執行基於證據的研究、代碼質量審查和人工決策介入,確保生成更安全、高質量的代碼。
NotebookLM MCP服務器的安全強化版本,提供零幻覺答案、Gemini深度研究、文檔API和程序化筆記本創建功能,具備14層企業級安全防護,包括後量子加密、證書固定和合規支持。
ExploitDB MCP服務器是一個提供漏洞數據庫查詢功能的模型上下文協議服務,由Cyreslab.ai開發,用於增強AI助手在網絡安全研究中的能力。
MCPwner是一個基於模型上下文協議的安全研究自動化服務器,集成了多種安全測試工具(SAST、SCA、秘密掃描等),為LLM驅動的安全分析工作流提供統一接口。
Linked API MCP服務器是一個連接LinkedIn賬戶與AI助手的工具,通過雲瀏覽器安全自動地實現潛在客戶搜索、消息發送、資料分析和市場研究等功能,適用於銷售自動化、招聘輔助和對話管理等場景。
DNStwist MCP服務器是一個用於DNS模糊測試的工具,幫助檢測域名仿冒和網絡釣魚的安全研究服務。