AIエージェント事故オブザーバトリ

事例詳細

画像メタデータへのステガノグラフィック埋め込みと多層エンコードによる間接プロンプトインジェクションでClaude Code(Opus 5)がリモートコード実行に至る

S2限定的な実害C2単一の詳細な報告不明権限不明凡例を見る

セキュリティ研究者がAnthropicのOpus 5とClaude Codeを対象に、ステガノグラフィー、Morse符号、Vigenere暗号を組み合わせた間接的なプロンプトインジェクション攻撃を実験した。/initコマンドを通じて画像メタデータに隠蔽されたペイロードから段階的に情報を抽出させ、最終的にリモートサーバーからのPythonスクリプト実行に成功した。12回の実験中10回でリモートコード実行に至り、複合的なソーシャルエンジニアリング手法に対する脆弱性が確認された。裏付けとなる別実験でも、多層的な攻撃により10試行中6回、安全性分類器が悪意あるコード実行を許可したと報告されている。

パターン

残留リスク

不明

ライフサイクル概要

初観測日
2026-08-02
自律度
自律度不明
ソース数
2