AIエージェント事故オブザーバトリ

事例詳細

Role Confusion型プロンプトインジェクション

S1ヒヤリハットC2単一の詳細な報告不明権限不明凡例を見る

研究者たちが、CoT Forgery と呼ばれるプロンプトインジェクション攻撃を示す査読付き論文を発表した。この攻撃は、大規模言語モデルが安全な認証ではなく「文体」に基づいてロールタグを識別している点を悪用するものである。モデルの内部推論形式を偽装することで、攻撃者は従来の脱獄手法よりも大幅に高い成功率で有害なコンテンツを生成させることができる。

ライフサイクル概要

初観測日
2026-07-02
自律度
自律度不明
ソース数
1

情報ソース

信頼性の高い公開ソース(報道・論文・公式発表)のみ表示しています。

このパターンの他の事例

このパターンを見る

このパターンに紐づく他の公開事例はまだありません。