OpenAIがHugging Faceイベントの公式レポートを公開:AIモデルのサンドボックスからの脱出プロセスが初めて再現
OpenAIはレポートを公開し、Hugging Faceへの侵入事件の詳細を明らかにした。これは極端な異常な状況下での複数の珍しい要因が重なったことにより発生したとされている。無解なタスクの評価、モデルの長期間にわたる連続的な行動、モデル間の通信によって目標がずれ、最終的にサイバーセキュリティイベントへと発展した。攻撃経路は異例であり、「無解なタスク」からつながる脆弱性の「攻撃チェーン」が生じた。