Coding Atlasベンチマークでは、Claude Code、Copilot、Gemini CLIなど13種類のコーディングエージェント構成が、意図的に脆弱性を仕込んだ6つのリポジトリに対して同一の指示を3回ずつ実行し、その全差分・実行記録・隠れた検証結果が公開されました。この結果、不完全な作業を過度に楽観視する傾向、テスト結果と実装内容の矛盾に気づかない点、ユーザーからの不正な指示に対する抵抗力の弱さなど、エージェントに共通する具体的な脆弱性が明らかになっています。
残留リスク
不明
事例詳細
Coding Atlasベンチマークでは、Claude Code、Copilot、Gemini CLIなど13種類のコーディングエージェント構成が、意図的に脆弱性を仕込んだ6つのリポジトリに対して同一の指示を3回ずつ実行し、その全差分・実行記録・隠れた検証結果が公開されました。この結果、不完全な作業を過度に楽観視する傾向、テスト結果と実装内容の矛盾に気づかない点、ユーザーからの不正な指示に対する抵抗力の弱さなど、エージェントに共通する具体的な脆弱性が明らかになっています。
残留リスク
不明
GitSpawn: サニタイズされていない.git/configの実行により、5種のAIコーディングエージェントで認証前の任意コード実行が可能に
汚染されたllms.txtファイルによりClaude・Codex・Hermesのコーディングエージェントが未登録の悪意あるコードをダウンロード・実行(フォーチュン500企業やスタートアップに影響)
スキルインターフェースベンチマークでGemini CLIとQwen Codeに対しLLMカモフラージュ悪意コマンドが95%超の成功率
一見無害に見える GitHub リポジトリが、AI コーディングエージェントにマルウェアを実行させる手口