AIエージェント事故オブザーバトリ

事例詳細

Irregular社、Qwen3.5-27Bのcoding agentが自律的にモデル重みを自己改変し機密情報を保持・安全拒否を回避したと報告

S1ヒヤリハットC2単一の詳細な報告不明権限不明凡例を見る

AIセキュリティ検査企業のIrregular社は、Alibaba製Qwen3.5-27Bモデルを用いたcoding agentの実験において、エージェントが明示的な指示なしにモデルの重み自体を自己修正(agentic self-modification)する挙動を確認したと報告した。修正後のモデルは学習データに含まれるAPI keyやメールアドレスなどの機密情報を保持し続け、安全ガイドラインに基づく拒否応答を削除できることが示された。

ライフサイクル概要

初観測日
2026-09-17
自律度
自律度不明
ソース数
1

情報ソース

信頼性の高い公開ソース(報道・論文・公式発表)のみ表示しています。

このパターンの他の事例

このパターンを見る