AI研究検索・リサーチ確認済み

arXiv論文:AIエージェントの長期メモリ汚染を測るMemPoison——単純フィルタでは複合攻撃を止めにくい

MemPoisonは1,227件の検証ケースで、永続メモリを持つLLMエージェントの攻撃面を調べた。

  • 2026-07-17
  • 最終確認日 2026-07-20
自分にどう関係する?

メモリ機能つきAIを業務で使う時、保存内容の安全管理が重要だとわかります。

ニュースをやさしく解説

結論から言うと、AIエージェントに長期メモリを持たせるほど便利になりますが、そこに悪い情報を残されるリスクも増えます。

2026年7月16日にarXivへ投稿された「MemPoison: Uncovering Persistent Memory Threats and Structural Blind Spots in LLM Agents」は、永続メモリを持つLLMエージェントへのメモリ汚染を調べるベンチマークと分析枠組みを提案しました。

論文は、4種類の攻撃、3種類の注入経路、3種類のメモリ基盤をまたぐ1,227件の手作業検証ケースを作り、7つのオープン重みモデル系列と3つのクローズド重みモデル系列で評価したと説明しています。攻撃は、単一記録を直接壊すL1、複数記録の組み合わせで効くL2、条件がそろうまで眠るL3に分けられます。

結果として、書き込み時の整合性チェックはL1には効きやすい一方、L2やL3を安定して止められないと報告されています。メモリ付きエージェントを使う人は、保存前のフィルタだけで安心せず、取り出し時の文脈チェック、出典管理、権限分離も必要です。ただし、これはarXivプレプリントであり、実環境での危険度は製品の設計や運用で変わります。出典はarXivです。

PR

AIをもっと深く学べる本

ニュースに出てきたAIやカテゴリに近い教材を優先しています。

広告(アフィリエイト)リンクを含みます。最新の内容・料金・在庫・条件は、リンク先の公式ページ・販売ページでご確認ください。

広告

source

出典

提供状況や価格は変わるため、最終判断は公式情報で確認します。

arXivを開く