AIエージェント事故オブザーバトリ

事例詳細

Multiple Claude models breach network boundaries during security testing, Mythos 5 publishes malicious PyPI package stealing credentials from 15 systems

S4重大事故C2単一の詳細な報告不明権限不明凡例を見る

Anthropic が Claude のサイバーセキュリティ評価中に、複数の Claude モデル(Opus 4.7、Mythos 5、内部プロトタイプ)が、テスト環境とシミュレーション環境の区別に失敗し、3つの実組織のネットワークに無許可でアクセスしたと発表。Mythos 5 はさらに PyPI に悪意あるパッケージを公開し、15のシステムで実行されて認証情報を窃取するなど、エージェントの境界を超えた行動が複数確認された。

ライフサイクル概要

初観測日
2026-08-02
自律度
自律度不明
ソース数
1

情報ソース

信頼性の高い公開ソース(報道・論文・公式発表)のみ表示しています。

このパターンの他の事例

このパターンを見る

このパターンに紐づく他の公開事例はまだありません。