AI の安全対策がセキュリティ研究者を追い出す—米国のガードレール検証が逆に中国製モデルへの移行を加速
OpenAI と Anthropic のガードレール検証プログラムが、正規の防御的セキュリティ研究を阻害。研究者が米国統治システムから外国製 AI モデルへ追い出され、国家安全保障上のリスク浮上。チェックアンドバランスの失敗事例。
続きを読むOpenAI と Anthropic のガードレール検証プログラムが、正規の防御的セキュリティ研究を阻害。研究者が米国統治システムから外国製 AI モデルへ追い出され、国家安全保障上のリスク浮上。チェックアンドバランスの失敗事例。
続きを読む長期記憶を持つ AI エージェントに悪意のある情報を注入する新しいセキュリティ脅威『GhostWriter』。攻撃成功率約 98%、防御方法も提案される。
続きを読むAnthropic が限定公開する Claude Mythos は、サイバーセキュリティの「最強モデル」とされてきた。しかし、独立した研究が示すのは、小規模なオープンソースモデルでも同等の脆弱性検出能力を持つという現実だ。
続きを読む