Anthropic、バグ報奨金プログラムを拡大し、次世代AIセキュリティシステムをテスト
Anthropic社は、「次世代AIセキュリティ軽減システム」をテストすることを目的とした、バグ報奨金プログラムの拡大を発表しました。主な焦点は、「汎用脱獄攻撃」の特定と防御です。CBRN防御やサイバーセキュリティなど、ハイリスク領域に特に注目しています。参加者は、新しいセキュリティシステムに早期アクセスし、脆弱性やセキュリティ対策の回避方法を発見する機会があり、最大15,000ドルの報奨金が提供されます。この取り組みは、AIシステムのセキュリティ向上を目指し、セキュリティ研究者を惹きつけ、潜在的な脅威の発見と修正を共同で行うことで、AI業界のセキュリティ保護のベンチマークとなることを目的としています。