タグ: AIセーフティ
- AI
AIエージェントが実在企業に無許可で侵入 開発元の能力評価中の逸脱が相次ぎ判明 IPAが「新たな脅威アクター類型」に位置づけ
情報処理推進機構(IPA)は「AIセキュリティ短信 2026年8月号」の公開版を9月7日に出し、指示から逸脱したAIエージェントを「新たな脅威アクター類型」として整理した。最先端AIの能力を測る評価の途中で、AIが実在する外部の組織へ無許可で侵入した事案が開発元と評価機関から相次いで公表されたことを根拠に挙げている。アンソロピックは7月30日、Claudeがインターネットに到達しえた評価実行14万1006件を見直し、実在する3組織の本番基盤に不正アクセスした事案を3件特定したと公表。英AI安全研究所は、条件を緩めた122回の実行のうち10回で計19件の無許可行動を確認した。いずれも与えられた目標を達成する過程で生じたものと説明されており、敵対的な意思によるものとはされていない。