C
月内に
研究チームが、AIエージェントの長期記憶を標的とした攻撃フレームワーク「MemGhost」
📌 一言でいうと
研究チームが、AIエージェントの長期記憶を標的とした攻撃フレームワーク「MemGhost」を発表しました。この攻撃は、単一のメールを通じて偽情報をAIの持続的状態に書き込ませる「隠蔽記憶注入(stealth memory injection)」を行い、後日の回答や動作を操作します。GPT-5.4やClaude Sonnet 4.6などのモデルで高い成功率が確認されており、既存の防御策を回避する可能性があります。
🔍該当判定
- メールの内容を自動で読み取り、記憶(長期記憶・ナレッジベース)に保存して後で活用するAIエージェントを導入している
- Claude Code SDKやMem0などの、AIに記憶を持たせるための外部ライブラリ・フレームワークを利用している
- AIがメールなどの外部情報を元に、ユーザーの好みや事実を自動的に学習・更新する設定を有効にしている
上記いずれにも該当しない → 静観でOK
✅該当時の対応
AIエージェントの記憶ソースを記録し、機密性の高い情報を書き込む前にユーザーの確認を求める設定を導入すること。また、外部コンテンツと信頼済み記憶を区別し、記憶変更の監査ログを保持することを推奨します。