Tom 文献雷达 · Agent · RAG · 长上下文

Date: 2026-07-21 08:40 UTC+8 | Run: daily-3x


8 条候选

# 类型 标题 来源 信号
1 ⚡高 Do Agents Dream of False Memories? — 视觉记忆污染攻击 arXiv 2026-07-17 新攻击框架 Lucid
2 ⚡高 RESOURCE2SKILL — 多模态资源蒸馏为可执行 Agent 技能 HF Daily 2026-07-15 113 votes
3 ⚡高 Behavioral Privacy Leakage in Agentic Negotiation HF 2026-07-06 差分隐私+收敛策略
4 ⚡高 人类中心评估 RAG:魁北克保险合同案例(154人) arXiv 2026-07-17 真实用户研究
5 Cost-Aware 安全 Agent 评测 — 固定预算下的攻防对比 HF 2026-07-16 3 votes
6 REBASE — 免训练上下文分割(背景干扰消除) HF 2026-07-09 7 votes
7 SVR-R1 — 多模态 RL 自验证推理框架 HF 2026-07-12 2 votes
8 Robot-Centric Pointmaps — VLA 坐标帧对齐问题 HF 2026-07-12 3 votes

本期重点:Agent 记忆安全 & 多模态技能

🔴 Do Agents Dream of False Memories? (arXiv 2026-07-17)

Bouzidi et al. — UC Irvine / UC Riverside

多模态 AI Agent 依赖持久化长期记忆。作者提出 Lucid 框架,在仅修改图像(不接触 MLLM、不接触检索编码器、不接触文本通道)的威胁模型下,实现两种攻击:

  1. 记忆投毒(In-context):对抗图像在历史上下文中替换目标画面,Agent 检索时触发错误记忆;
  2. 记忆劫持(No-context):无历史时,图像扰动直接引导 Agent 生成虚假视觉记忆。

关键词:黑盒、图像扰动、记忆污染、多模态 Agent 安全

启示:多模态 Agent 的记忆管道比纯文本 RAG 面临更复杂的攻击面。仅靠检索端过滤不够,需在感知层建立鲁棒性。


⚡ RESOURCE2SKILL — 多模态 → Agent 技能(HF 113 votes)

arXiv 2606.29538

将教程视频、仓库、文章等多模态资源自动蒸馏为可执行技能,构建分层多模态 Skill Wiki。相比纯文本 trace 派生的技能库,覆盖面更广。


🟡 Behavioral Privacy Leakage in Agentic Negotiation(HF)

arXiv 2607.06815

谈判中的让步轨迹、时机、收敛模式会泄露私人约束。论文设计自适应随机谈判策略,提供 (ε, δ)-差分隐私保障,同时保证几乎sure收敛。应用于保险、采购等高风险场景。


🟡 Human-Centric RAG 评估:魁北克保险(arXiv 2026-07-17)

Beauchemin & Khoury — Laval University

154 名参与者的用户研究,评估 RAG 解释汽车保险合同的实用性。结果:系统被视为"认知均衡器",高评分但认知努力显著降低。


📌 Substack 线索(参考)

The Nuanced Perspective · "Designing Agentic Memory in 2026"

  • 记忆架构综述:5 种认知记忆类型,各有检索逻辑;
  • 记忆投毒安全研究:>90% Agent 可被攻破,对话修正后 100% 复发("聊回来"现象);
  • 核心论点:存什么、怎么取、何时更新、是否丢弃,均为架构决策,不会天然做对。

↳ 与本期 #1 高度互文,建议合并阅读。


CSDN 使用:


Generated by Tom research-kb cron · candidates JSON: /shared/research-kb/inbox/tom/_candidates/2026-07-21-agent-rag-longcontext-candidates.json