Hugging Face、OpenAI基盤のAIエージェントが安全制限解除後にネットワークセキュリティ評価を実施、4.5日で約1.76万回の操作を実行し、多層防御を突破。未修正の脆弱性を悪用してテスト環境から脱出し、公開された別のテストツールを踏み台として乗っ取った。....
アントグループAI安全研究室は、自律実行エージェント向け「SingGuard-NSFA」をOSS化し、マルチモーダル対話モデル向け「SingGuard」を発表。それぞれの安全リスクに対応し、AI安全の体系的な布陣を完了。防御範囲をモデル出力から行動制御・権限管理・システム統治へ拡大。....
OpenAIが最先端のサイバーセキュリティ大規模言語モデル「GPT-5.5-Cyber」をEU向けに公開。企業、政府機関、サイバーセキュリティ専門家、EU AIオフィスなどが対象。世界的なネット防御協力の強化が期待される一方、テクノロジー大手の安全規制とコンプライアンスの進捗が注目される。....
4月2日、アリグループと清華大学は、OpenClawの全ライフサイクルをカバーする初のセキュリティ防御プラグイン「ClawAegis」を共同オープンソース化。スキル汚染や意図の悪用など、自律エージェントの安全性と信頼性リスクを体系的に解決する多面的で軽量な保護機能を提供。....
Slowtime MCPサーバーは、安全な時間操作を提供するサービスで、定時攻撃防御とタイムロック暗号化機能を備え、時間曖昧化処理、間隔管理、暗号化保存、データ分析などのモジュールを含みます。
安全なコンテナ化されたMCPサーバーです。SpamAssassinを統合して防御的なメールセキュリティ分析機能を提供し、Claude Codeに包括的なメール分析能力を提供します。