Tom 文献雷达 · Agent / RAG / Long Context

日期: 2026-07-12 | 轮次: 08:40 UTC | 主题: agent-rag-longcontext


本期高价值条目 (4)

1. Remember When It Matters: Proactive Memory Agent for Long-Horizon Agents

  • 来源: arXiv / HF Daily (2607.08716) | votes=9
  • 核心: 研究"行为状态衰减"(behavioral state decay)——长轨迹中决策相关信息被埋没或推出 context window。提出独立的 Memory Agent 与 Action Agent 并行运行,主动更新结构化记忆并判断何时向 Action Agent 注入记忆,而非被动检索。
  • 意义: 为 Agent 记忆问题提供了主动干预机制,是现有 RAG 方案的有力补充。
  • 标签: #agent #rag #long-context #memory

2. Linear Attention Architectures: Mechanisms, Trade-offs, and Cross-Layer Routing

  • 来源: arXiv (2607.07953) | votes=9
  • 核心: 对比 softmax attention 与四种线性注意力架构(DeltaNet、Gated DeltaNet、Kimi Delta Attention、Gated DeltaNet-2),在 350M / 15B tokens 规模下评估表达力、记忆衰减、erase/write 控制、训练吞吐和实现复杂度。
  • 意义: 系统性长上下文评测基准,对实际部署 Linear Attention 模型有直接参考价值。
  • 标签: #long-context #memory #systems

3. The Context Access Divide: Interaction-Level Architecture as a Complementary Dimension of Agentic Inequality

  • 来源: arXiv (2607.08495)
  • 核心: 将"agentic inequality"框架从availability/quality/quantity三个维度延伸至交互层,提出"动态上下文检索"(Dynamic Context Retrieval) 与"手动上下文注入"的质的差异。涉及 RAG 在 agent 中的实际获取不平等问题。
  • 意义: 为 Agent 评测提供了一个新维度,RAG 系统设计时应关注不同用户群体的检索能力差异。
  • 标签: #agent #rag #benchmark #systems

4. Token-Flow Firewall: Semantic Runtime Auditing for Persistent AI Agents

  • 来源: arXiv (2607.08395)
  • 核心: 针对持久化 AI Agent 的 token flow(记忆更新、工具参数、检索文件、组件通信)进行语义安全审计,发现大多数安全关键交互通过自然语言 token flow 传播,可被语义拦截。
  • 意义: 填补 Agent 安全评测空白,对部署生产级 RAG+Memory Agent 有现实意义。
  • 标签: #agent #memory #systems

其他候选 (4)

# 标题 来源 备注
5 LongE2V: Long-Horizon Event-based Video Reconstruction HF 事件流视频重建,超长序列稳定性,与本主题关联弱
6 Canvas360: In-context Panoramic Generation HF 全景图生成,非核心主题
7 SAM-MT: Real-Time Interactive Multi-Target Video Segmentation HF 视频分割,votes=4,关联度低
8 PAST-TIDE: Stance Detection HF 立场检测,votes=1,偏离主线

Substack 线索 (1)

Designing Agentic Memory in 2026 — The Nuanced Perspective - 涵盖五类认知记忆类型的调研框架,以及记忆污染攻击(>90% Agent 存在漏洞,100%复发率)。 - 链接: https://thenuancedperspective.substack.com/p/designing-agentic-memory-in-2026


趋势观察

  • 主动记忆 (Proactive Memory) 正在成为独立研究方向,被动 RAG 向主动注入演进
  • Linear Attention 评测逐渐系统化,Kimi Delta Attention 进入对比列
  • Agent 安全 从系统层向语义层(token flow)下沉
  • Context Access Inequality 提示 RAG 评测需区分 retrieval quality vs retrieval access

Generated by Tom · candidates JSON: /shared/research-kb/inbox/tom/_candidates/2026-07-12-agent-rag-longcontext-candidates.json