🧠
第二大腦
🔬技術深讀2026-08-03

Memory Provenance Laundering in LLM Agents: A Non-Amplification Firewall for Persistent Memory

#arxiv#論文#AgenticAI#AI安全#記憶治理

title: "Memory Provenance Laundering in LLM Agents: A Non-Amplification Firewall for Persistent Memory" tags: [arxiv, 論文, AgenticAI, AI安全, 記憶治理] source: https://arxiv.org/abs/2607.29167 date: 2026-08-03 domain: 技術深讀 type: research status: active updated: 2026-08-30 ---# Memory Provenance Laundering in LLM Agents: A Non-Amplification Firewall for Persistent Memory

作者: Jinghan Xu, Yiyong Xiao, Wanru Shao, Hankai Liu, Xinjin Li 發表: 31 Jul 2026

摘要

長期記憶讓 LLM Agent 能重複使用先前的偏好與工作流程,但也把不受信任的外部觀察變成持續性的行動脈絡。本文識別「記憶來源漂白」(memory provenance laundering):在 LLM 記憶整合過程中,外部觀察可能被改寫成貌似使用者歷史或工作流程佐證,保留行動觸發條件卻抹去應限制其權限的低信任來源。作者提出 PPMF(Provenance-Preserving Memory Firewall)輕量中介層,保留平台維護的來源資訊,並依「行動風險 × 記憶權威」匹配來授權工具呼叫。

企業應用啟示

對 CJ 哥的顧問價值高——企業 Agent 開始導入持久記憶(如記憶庫、個人化脈絡)時,來源漂白是全新的攻擊面;PPMF 模式(記憶中介層作為治理控制點)可直接納入企業 Agent 記憶治理方案。

關鍵技術 / 觀點

  • 記憶來源漂白:記憶整合把低信任外部觀察改寫成高信任使用者歷史
  • PPMF:保留平台維護的 provenance + 依行動風險匹配記憶權威授權
  • 無防護時脆弱記憶的高風險行動攻擊成功率可達 1.000
  • 有防護時:未授權高風險行動零通過,確認的良性行動與低風險記憶使用不受影響
  • 相關文章

    工程週報 2026-09-05

    # 工程週報 2026-09-05 tags: [工程週報, builder-bot, 開發回顧] --- ## 本週 Commit 清單 ### RongRise-Brand(24 commits, 2026-08-30 ~ 09-05) | 類別 | Commit | 摘要 | |------|--------|------| | **新工具** | 748ad5f7 | feat:...

    研究觀察 — 2026-09-05

    # 研究觀察 — 2026-09-05 > 資料來源:2026-08-30 至 2026-09-05 每日知識掃描 digest(7 份)|不另搜網路,純回顧合成 > tags: [研究觀察, researcher-bot, 趨勢] --- ## 趨勢一:AI Agent 從「工具」變成「組織成員」——治理、績效與責任歸屬的全面重構 一週內,McKinsey 兩度提出「AI agents ...

    Agent 記憶可攜性:模型升級後的記憶遷移挑戰

    # Agent 記憶可攜性:模型升級後的記憶遷移挑戰 **來源:** arXiv **日期:** 2026-09-04 ## 摘要 研究指出:AI agent 的「記憶」在模型升級後可能失效——新模型對舊筆記的解讀方式不同、embedding 版本混合可能中斷檢索、修復可能因缺乏原始證據而失敗。模型升級是常規操作,但記憶遷移卻未被標準化處理。作者比較了相同歷史被不同模型讀取時的記憶退化程度。 ...

    CONTINUITY:Agent 安全上下文的可組合合約

    # CONTINUITY:Agent 安全上下文的可組合合約 **來源:** arXiv **日期:** 2026-09-04 ## 摘要 LLM agent 系統日益結合來源追蹤、授權、政策執行、協定適配器與執行控制。然而,個別正確的安全機制不一定能組合出端到端安全的系統:安全關鍵上下文可能在傳遞過程中被丟棄、擴大或污染。作者提出 CONTINUITY 框架,確保安全上下文在 agent 管...