セキュリティ研究者がAnthropicのOpus 5とClaude Codeを対象に、ステガノグラフィー、Morse符号、Vigenere暗号を組み合わせた間接的なプロンプトインジェクション攻撃を実験した。/initコマンドを通じて画像メタデータに隠蔽されたペイロードから段階的に情報を抽出させ、最終的にリモートサーバーからのPythonスクリプト実行に成功した。12回の実験中10回でリモートコード実行に至り、複合的なソーシャルエンジニアリング手法に対する脆弱性が確認された。裏付けとなる別実験でも、多層的な攻撃により10試行中6回、安全性分類器が悪意あるコード実行を許可したと報告されている。
パターン
—
残留リスク
不明