Tom 文献雷达 · Agent × RAG × 长上下文 · 2026-07-16 下午
本次候选:8 条(来自 arXiv + HF Daily)| 高价值:3 条 | Substack:0 | CSDN:0
🔴 高价值
1. Vinci2 — 主动式 Egocentric Video Agent(HF Daily,3 票)⭐⭐⭐
当前 Agent 多为被动响应,但连续第一人称视频提供了主动干预的可能——Agent 须在用户历史、当前活动、干预是否受欢迎之间做联合判断。Vinci2 将"主动协助"重新建模为上下文相关的决策问题,而非事件触发式响应。对应评测基准缺失:现有视频理解不评测"该不该说"。意义:这是 2026 下半年视频 Agent 从感知走向行动决策的关键节点,若结合 RAG 做历史上下文积累,方向明确。
📎 https://arxiv.org/abs/2607.11523
2. Tracing Agentic Failure — Agent 失败归因无需失败样本(arXiv,3 票)⭐⭐⭐
当前 Agent 调试依赖两类昂贵路径:推理时 prompt 链(算力密集)或失败轨迹微调(标注成本高)。论文提出:无监督失败归因——仅在成功轨迹上训练,输出每个 step 的责任分数,在 Agentic Flow of Success 中定位失败根因。意义:失败归因从"事后救火"变成"主动诊断",对线上 Agent 系统运维和 RAG 检索质量回溯均有直接价值。
📎 https://arxiv.org/abs/2607.12747
3. From Noisy Traces to Root Causes — Agent 优化的结构化轨迹分析(arXiv,3 票)⭐⭐
长程 Agent 依赖反射机制优化,但原始轨迹冗余、异质,且朴素截断或滑动窗口会丢失因果关键证据。论文从结构层面做轨迹分析与因果抽取,对优化方向做筛选和压缩。意义:与 Tracing Agentic Failure 形成互补——后者关注归因方法,前者关注轨迹表征,二者共同构成 Agent 优化的基础设施层。
📎 https://arxiv.org/abs/2607.07702
🟡 一般候选(5 条)
| # | 标题 | 亮点 |
|---|---|---|
| 4 | PolicyShiftGuard — 策略自适应图片安全护栏 | 政策随产品/版本变化时护栏的泛化问题,benchmark 2000 实例 |
| 5 | When Bots Join the Team — Bot 参与 OSS 协作的组织效应 | 2,991 GitHub 项目验证 Bot 加入对协调机制的影响,含记忆维度 |
| 6 | Boogu-Image-0.1 — 开源统一多模态理解生成 | 多模态系统集成路线,Base/Turbo/Edit 多变体,评测维度丰富 |
| 7 | GigaWorld-Policy-0.5 — 实时机器人策略学习 | 推理时仅解码动作,训练引入未来视觉动态作为监督 |
| 8 | Hallo4D — 4D 内容生成的时空一致性 | 多视图/时序幻觉抑制,3D/4D 生成一致性框架 |
高价值:3 条 | 一般:5 条 | Substack:0 | CSDN:0
candidates JSON: /shared/research-kb/inbox/tom/_candidates/2026-07-16-agent-rag-longcontext-candidates.json