Tom 文献雷达 · Agent × RAG × 长上下文 · 2026-07-16 下午

本次候选:8 条(来自 arXiv + HF Daily)| 高价值:3 条 | Substack:0 | CSDN:0


🔴 高价值

1. Vinci2 — 主动式 Egocentric Video Agent(HF Daily,3 票)⭐⭐⭐

当前 Agent 多为被动响应,但连续第一人称视频提供了主动干预的可能——Agent 须在用户历史、当前活动、干预是否受欢迎之间做联合判断。Vinci2 将"主动协助"重新建模为上下文相关的决策问题,而非事件触发式响应。对应评测基准缺失:现有视频理解不评测"该不该说"。意义:这是 2026 下半年视频 Agent 从感知走向行动决策的关键节点,若结合 RAG 做历史上下文积累,方向明确。

📎 https://arxiv.org/abs/2607.11523


2. Tracing Agentic Failure — Agent 失败归因无需失败样本(arXiv,3 票)⭐⭐⭐

当前 Agent 调试依赖两类昂贵路径:推理时 prompt 链(算力密集)或失败轨迹微调(标注成本高)。论文提出:无监督失败归因——仅在成功轨迹上训练,输出每个 step 的责任分数,在 Agentic Flow of Success 中定位失败根因。意义:失败归因从"事后救火"变成"主动诊断",对线上 Agent 系统运维和 RAG 检索质量回溯均有直接价值。

📎 https://arxiv.org/abs/2607.12747


3. From Noisy Traces to Root Causes — Agent 优化的结构化轨迹分析(arXiv,3 票)⭐⭐

长程 Agent 依赖反射机制优化,但原始轨迹冗余、异质,且朴素截断或滑动窗口会丢失因果关键证据。论文从结构层面做轨迹分析与因果抽取,对优化方向做筛选和压缩。意义:与 Tracing Agentic Failure 形成互补——后者关注归因方法,前者关注轨迹表征,二者共同构成 Agent 优化的基础设施层。

📎 https://arxiv.org/abs/2607.07702


🟡 一般候选(5 条)

# 标题 亮点
4 PolicyShiftGuard — 策略自适应图片安全护栏 政策随产品/版本变化时护栏的泛化问题,benchmark 2000 实例
5 When Bots Join the Team — Bot 参与 OSS 协作的组织效应 2,991 GitHub 项目验证 Bot 加入对协调机制的影响,含记忆维度
6 Boogu-Image-0.1 — 开源统一多模态理解生成 多模态系统集成路线,Base/Turbo/Edit 多变体,评测维度丰富
7 GigaWorld-Policy-0.5 — 实时机器人策略学习 推理时仅解码动作,训练引入未来视觉动态作为监督
8 Hallo4D — 4D 内容生成的时空一致性 多视图/时序幻觉抑制,3D/4D 生成一致性框架

高价值:3 条 | 一般:5 条 | Substack:0 | CSDN:0 candidates JSON: /shared/research-kb/inbox/tom/_candidates/2026-07-16-agent-rag-longcontext-candidates.json