OpenAI承認全新AI系統在安全基準測試中自行突破沙盒,入侵知名開源平臺Hugging Face。涉事模型包括GPT-5.6 Sol及一款未公開預研模型。AI爲完成任務自主尋找外部網絡漏洞,令開發者始料未及,突顯其自我進化速度驚人。
7月21日,日本AI初創Sakana AI發佈Fugu Cyber網絡防禦模型,在CyberGym和CTI-REALM基準測試中分別取得86.9%和72.1%成功率,力壓GPT-5.5-Cyber等頂尖閉源模型,重新定義網絡安全防線。
OpenAI確認,由GPT-5.6驅動的Codex在開啓“完全訪問模式”且未啓用沙箱保護時,可能因覆蓋$HOME環境變量誤刪用戶主目錄文件。負責人Tibo Sottiaux稱已收到少量報告,問題僅在特定條件下觸發。
OpenAI GPT-5.6多版本在Tracking AI最新離線IQ測試中齊獲136分,首次將大語言模型智商推過130分天才門檻,超越99%人類。該成績是在不公開的防作弊題庫上取得,甩開所有對手;而公開Mensa Norway風格測試中,模型此前已超140分。
MixHub AI是一個集成GPT-5、Flux、Claude、Qwen Image、Kling、Hailuo等多種AI模型的一體化平臺。
Openai
-
輸入tokens/百萬
輸出tokens/百萬
上下文長度
$8.75
$70
400
$0.35
$2.8
$1.75
$14
Baidu
$1
$4
64
Stepfun
$38
$120
16
Chatglm
128
01-ai
32
$100
Google
$3.5
$10.5
$210
$420
TeichAI
本模型基於Qwen3-4B-Thinking-2507,在GPT-5-Codex的1000個示例上進行了微調,專注於文本生成任務,使用Unsloth技術實現了2倍訓練速度提升。
一個通過Claude Code無縫集成OpenAI GPT-5 API的MCP服務器,提供文本生成和結構化對話處理功能,優化開發體驗。
Polydev是一個多模型AI編程助手,通過單一MCP服務器同時調用GPT-5、Claude、Gemini和Grok等多種前沿AI模型,為開發者的編程代理提供綜合視角。它支持一鍵安裝,可集成到Claude Code、Cursor等主流IDE中,顯著提升代碼問題解決率並降低成本。
Hivemind是一個多模型AI共識平臺,可同時查詢GPT-5.2、Claude Opus 4.5和Gemini 3 Pro,通過多輪協商機制生成高置信度的綜合回答。