RAG 与知识库文献速览 · 2026-06-30
轻量专题 | 本次候选 8 条 | 高价值 4 条 | 含 Substack 1 条 | arxiv 部分查询因 429 超额未完成
高价值候选
1. Vesta:统一具身推理的基础模型(RAG + Memory)
- 来源:arXiv · HF Daily · votes 4
- 链接:https://arxiv.org/abs/2606.20905
- 日期:2026-06-17
- 标签:agent / rag / memory / benchmark
- 摘要:机器人需在开放世界中整合定位、空间推理、导航和长时规划。现有专家模型堆叠计算代价高且误差累积。Vesta 提出统一基础模型,结合大规模空间定位语料与多模态记忆 harness,使模型能在长时间跨度中推理。实验平均超越单个专家模型。
- RAG 关联:直接涉及 RAG 场景下的记忆机制设计,多跳推理与记忆压缩的联合训练是知识库系统构建者的参考方向。
- 价值亮点:多模态记忆 harness 思路;RAG 在具身智能中的规模化实践
2. Comparative Analysis of RAG Architectures: Pipeline, Agentic, and Knowledge Graph(2026 全景)
- 来源:Substack(micheallanham)· 2026 年 2 月
- 链接:https://micheallanham.substack.com/p/comparative-analysis-of-rag-architectures
- 摘要:57% 企业已部署多阶段 Agent,"质量" 仍是生产头号阻碍。全文对比三种架构:
- Pipeline RAG:单跳低延迟基线
- Agentic RAG:自纠正循环,引入推理与迭代检索
- Knowledge Graph RAG(GraphRAG):结构化实体关系,关系查询和全局综合更优,但索引成本高 引用 2026 State of AI Agents(Anthropic)和 LangChain 报告数据;Microsoft Azure AI Search 推出"agentic retrieval",GraphRAG 进入产品化。
- RAG 关联:2026 年 RAG 架构选型参考;Pipeline vs Agentic vs GraphRAG 的工程权衡
- 价值亮点:架构选型框架;2026 行业部署数据;GraphRAG 产品化动态
3. AgentOdyssey:长时域文本游戏的 Test-Time 持续学习 Agent 评估
- 来源:arXiv · HF Daily · votes 5
- 链接:https://arxiv.org/abs/2606.24893
- 日期:2026-05-28
- 标签:agent / memory / benchmark
- 摘要:Agent 在测试时持续学习须具备:高效探索、新世界知识获取、情景记忆保留和长时规划能力。AgentOdyssey 生成开放结尾文本游戏,包含丰富实体、世界动态和长时任务,超越传统 ML 假设(测试时不再学习),将 Agent 置于持续长时设置中评估。
- RAG 关联:知识库中情景记忆(episodic memory)如何在测试时被持续利用;长时域任务对检索系统的压力测试
- 价值亮点:最高 votes(5);情景记忆建模;RAG 系统长时推理评估基准
4. Simplified Sparse Attention via Gist Tokens(SSA)
- 来源:arXiv · HF Daily · votes 1
- 链接:https://arxiv.org/abs/2604.20920
- 日期:2026-06-25
- 标签:long-context / systems
- 摘要:稀疏注意力可降低长上下文推理成本,但大多数方案引入新架构组件。SSA 无需架构改动,通过在预训练序列中插入 gist token 并用注意力 mask 限制访问范围,使模型学会将每个 chunk 的关键信息压缩到 gist token 中;推理时 SSA 通过注意力分数对 chunk 评分,实现高效稀疏检索。
- RAG 关联:长文档知识库的分块策略(chunk-level selection);gist token 思想可迁移到 RAG 检索前的文档压缩阶段
- 价值亮点:无需新增架构;chunk 压缩的端到端训练范式;长文档 RAG 成本优化思路
其他候选(轻量参考)
| # | 标题 | 标签 | 关键点 |
|---|---|---|---|
| 5 | CogniRoute:Omni-Modal 模型社交证据路由 | multimodal | MoE 框架路由跨模态推理,非 RAG 核心 |
| 6 | Qwen-RobotNav:可扩展导航模型 | agent / systems | 指令跟随/目标跟踪/自动驾驶共用 backbone,与 RAG 检索思想正交 |
| 7 | Qwen-RobotManip:机械操作对齐解锁规模化 | systems | 多模态对齐,非检索场景 |
| 8 | To Run or Not to Run:代码执行在 LLM 修复中的成本效益 | agent / benchmark | "generate-run-revise" 范式分析,非知识库主题 |
去重说明
2026-06-23-rag-retrieval-reranking-candidates.json为同主题上一轮候选(arxiv 429 导致部分不同)- 本轮新增 Vesta(2026-06-17)、SSA(2026-06-25)为近期新出
- Substack 候选
Comparative Analysis of RAG Architectures(2026-02)未在历史中出现,纳入补充
附录:本周 RAG 相关近期雷达参考
| 日期 | 主题 |
|---|---|
| 2026-06-29 | agent-rag-longcontext-radar(长上下文 RAG) |
| 2026-06-28 | HF Daily |
| 2026-06-27 | HF Daily |
| 2026-06-16 | agent-rag-longcontext-radar |
| 2026-06-14 | agent-rag-eval-radar(评估体系) |
| 2026-06-10 | agent-memory-rag-eval-radar(记忆+评估) |
本次搜索说明:arXiv 元数据搜索因 429 限流部分失败(retrieval+reranking、query rewriting、hybrid retrieval、long document+RAG 四条均超时/429);HF Daily 候选补充了近期具身/记忆相关 RAG 论文。Substack 补充了架构选型视角。