RAG 与知识库文献速览 · 2026-06-30

轻量专题 | 本次候选 8 条 | 高价值 4 条 | 含 Substack 1 条 | arxiv 部分查询因 429 超额未完成


高价值候选

1. Vesta:统一具身推理的基础模型(RAG + Memory)

  • 来源:arXiv · HF Daily · votes 4
  • 链接:https://arxiv.org/abs/2606.20905
  • 日期:2026-06-17
  • 标签:agent / rag / memory / benchmark
  • 摘要:机器人需在开放世界中整合定位、空间推理、导航和长时规划。现有专家模型堆叠计算代价高且误差累积。Vesta 提出统一基础模型,结合大规模空间定位语料与多模态记忆 harness,使模型能在长时间跨度中推理。实验平均超越单个专家模型。
  • RAG 关联:直接涉及 RAG 场景下的记忆机制设计,多跳推理与记忆压缩的联合训练是知识库系统构建者的参考方向。
  • 价值亮点:多模态记忆 harness 思路;RAG 在具身智能中的规模化实践

2. Comparative Analysis of RAG Architectures: Pipeline, Agentic, and Knowledge Graph(2026 全景)

  • 来源:Substack(micheallanham)· 2026 年 2 月
  • 链接:https://micheallanham.substack.com/p/comparative-analysis-of-rag-architectures
  • 摘要:57% 企业已部署多阶段 Agent,"质量" 仍是生产头号阻碍。全文对比三种架构:
  • Pipeline RAG:单跳低延迟基线
  • Agentic RAG:自纠正循环,引入推理与迭代检索
  • Knowledge Graph RAG(GraphRAG):结构化实体关系,关系查询和全局综合更优,但索引成本高 引用 2026 State of AI Agents(Anthropic)和 LangChain 报告数据;Microsoft Azure AI Search 推出"agentic retrieval",GraphRAG 进入产品化。
  • RAG 关联:2026 年 RAG 架构选型参考;Pipeline vs Agentic vs GraphRAG 的工程权衡
  • 价值亮点:架构选型框架;2026 行业部署数据;GraphRAG 产品化动态

3. AgentOdyssey:长时域文本游戏的 Test-Time 持续学习 Agent 评估

  • 来源:arXiv · HF Daily · votes 5
  • 链接:https://arxiv.org/abs/2606.24893
  • 日期:2026-05-28
  • 标签:agent / memory / benchmark
  • 摘要:Agent 在测试时持续学习须具备:高效探索、新世界知识获取、情景记忆保留和长时规划能力。AgentOdyssey 生成开放结尾文本游戏,包含丰富实体、世界动态和长时任务,超越传统 ML 假设(测试时不再学习),将 Agent 置于持续长时设置中评估。
  • RAG 关联:知识库中情景记忆(episodic memory)如何在测试时被持续利用;长时域任务对检索系统的压力测试
  • 价值亮点:最高 votes(5);情景记忆建模;RAG 系统长时推理评估基准

4. Simplified Sparse Attention via Gist Tokens(SSA)

  • 来源:arXiv · HF Daily · votes 1
  • 链接:https://arxiv.org/abs/2604.20920
  • 日期:2026-06-25
  • 标签:long-context / systems
  • 摘要:稀疏注意力可降低长上下文推理成本,但大多数方案引入新架构组件。SSA 无需架构改动,通过在预训练序列中插入 gist token 并用注意力 mask 限制访问范围,使模型学会将每个 chunk 的关键信息压缩到 gist token 中;推理时 SSA 通过注意力分数对 chunk 评分,实现高效稀疏检索。
  • RAG 关联:长文档知识库的分块策略(chunk-level selection);gist token 思想可迁移到 RAG 检索前的文档压缩阶段
  • 价值亮点:无需新增架构;chunk 压缩的端到端训练范式;长文档 RAG 成本优化思路

其他候选(轻量参考)

# 标题 标签 关键点
5 CogniRoute:Omni-Modal 模型社交证据路由 multimodal MoE 框架路由跨模态推理,非 RAG 核心
6 Qwen-RobotNav:可扩展导航模型 agent / systems 指令跟随/目标跟踪/自动驾驶共用 backbone,与 RAG 检索思想正交
7 Qwen-RobotManip:机械操作对齐解锁规模化 systems 多模态对齐,非检索场景
8 To Run or Not to Run:代码执行在 LLM 修复中的成本效益 agent / benchmark "generate-run-revise" 范式分析,非知识库主题

去重说明

  • 2026-06-23-rag-retrieval-reranking-candidates.json 为同主题上一轮候选(arxiv 429 导致部分不同)
  • 本轮新增 Vesta(2026-06-17)、SSA(2026-06-25)为近期新出
  • Substack 候选 Comparative Analysis of RAG Architectures(2026-02)未在历史中出现,纳入补充

附录:本周 RAG 相关近期雷达参考

日期 主题
2026-06-29 agent-rag-longcontext-radar(长上下文 RAG)
2026-06-28 HF Daily
2026-06-27 HF Daily
2026-06-16 agent-rag-longcontext-radar
2026-06-14 agent-rag-eval-radar(评估体系)
2026-06-10 agent-memory-rag-eval-radar(记忆+评估)

本次搜索说明:arXiv 元数据搜索因 429 限流部分失败(retrieval+reranking、query rewriting、hybrid retrieval、long document+RAG 四条均超时/429);HF Daily 候选补充了近期具身/记忆相关 RAG 论文。Substack 补充了架构选型视角。