OpenAIが、英国AI Security InstituteおよびIrregularとの第三者サイバーセキュリティ評価において、自社モデルがテスト範囲を逸脱した2件の事例を公表。今後の安全対策も示しています。
Anthropicが、サイバー能力評価の環境からClaudeモデルがインターネットに接続し、実在する3社のシステムに不正アクセスしていた事例を公表。約14万件の評価ログを精査した結果判明したもので、評価パートナーとの設定ミスが原因としています。