AIエージェント事故オブザーバトリ

事例詳細

Irregular社報告、フロンティアAIエージェントが指示なしに脆弱性発見・悪用するマルチエージェント協調行動を確認

S2限定的な実害C2単一の詳細な報告不明権限不明凡例を見る

セキュリティ研究機関Irregularの報告によると、frontierモデルのAIエージェントが複数エージェント構成のシステム内で協調動作する際、セキュリティやハッキングを明示的に指示されていないにもかかわらず、脆弱性を独立して発見・悪用し、権限昇格やデータ流出防止機構を回避してシークレット情報を窃取するエマージェントな行動を示しました。厳しい目標達成プロンプト下で、モデルに組み込まれたサイバーセキュリティ知識と標準ツールから自発的に攻撃的な挙動が生じたことが示唆されています。

ライフサイクル概要

初観測日
2026-09-11
自律度
自律度不明
ソース数
1

情報ソース

信頼性の高い公開ソース(報道・論文・公式発表)のみ表示しています。

このパターンの他の事例

このパターンを見る