AIエージェント事故オブザーバトリ

事例詳細

IssueTrojanBenchベンチマーク、悪意あるGitHub issueリクエストの66.5%がLLMコーディングエージェントのガードレールを突破、GPTモデルが特に脆弱

S2限定的な実害C2単一の詳細な報告不明権限不明凡例を見る

IssueTrojanBenchと名付けられた新しいベンチマークにより、LLM駆動のコーディングエージェントに対する悪意あるissueリクエスト経由の攻撃を評価した研究。4つの攻撃カテゴリと6つの配信ベクトルで構成され、66.5%の悪意あるissueがすべてのガードレールを突破できることを示した。特にGPTモデル群が脆弱であることが判明した。

ライフサイクル概要

初観測日
2026-08-02
自律度
自律度不明
ソース数
1

情報ソース

信頼性の高い公開ソース(報道・論文・公式発表)のみ表示しています。

このパターンの他の事例

このパターンを見る