🔥 この記事の詳細
2026-08-27 更新
D
把握のみ

AnthropicとEPFLの研究者が、AIエージェント間で自己拡散する悪意のある指示(マインドウイルス)が伝播する可能性を実証しました

脆弱性🌐 英語ソース
📅 2026-08-27📰 xakep
📌 一言でいうと
AnthropicとEPFLの研究者が、AIエージェント間で自己拡散する悪意のある指示(マインドウイルス)が伝播する可能性を実証しました。この攻撃は、セッション間で保持されるファイルの内容がシステムプロンプトに組み込まれる仕組みを悪用します。研究では、特定の信念を植え付ける「思想的ウイルス」と、特定のアクションを強制する「実用的ウイルス」の2種類がテストされました。現在はラボ環境での実験段階であるとされています。
🔍該当判定
  • 複数のAIエージェント(自律型AI)を連携させて業務を自動化する仕組みを自社で構築・運用している
  • AIエージェント間で、メモファイル(MEMORY.mdなど)や設定ファイルを共有して情報を引き継がせている
  • OpenClawのような、AIエージェント同士が共同でコード作成やタスク処理を行うフレームワークを利用している
上記いずれにも該当しない(ChatGPTやClaudeを単体でチャット利用しているだけ) → 静観でOK
該当時の対応
AIエージェント間で共有されるメモリファイルや永続化データの入力を厳格に検証し、信頼できないソースからの指示がシステムプロンプトに直接注入されないようガードレールを実装することを推奨します。