Tom 文献雷达 · Agent · RAG · 长上下文 · 2026-08-16 08:40 UTC
🔥 高价值条目(4 条)
1. Maglev: Sliding Recurrent Memory
- 来源: HF · arXiv:2608.02870
- 标签:
ragmemory - 亮点: 固定记忆循环 Transformer,可并行训练,泛化滑动窗口注意力。Prefiller Q 访问完整历史生成记忆目标,decoder P 仅用滑动窗口 + 循环 K/V 注入,兼顾并行训练与推理效率。长上下文记忆建模的工程可行方案。
- 启示: 固定记忆架构 vs 上下文窗口扩展的成本对比值得持续跟踪。
2. When Should Multi-Round RAG Stop?
- 来源: arXiv:2608.13237(2026-08-13)
- 作者: Weimeng Luo
- 标签:
ragbenchmark - 亮点: Search-R1 的停止判断被建模为序贯选择问题而非独立状态分类。训练 Qwen3.5-2B 判断停止阈值,在 900 题 HotpotQA 上验证。因首个 STOP 决定整条轨迹,传统独立分类存在系统性偏差。
- 启示: 多轮检索的"何时停止"是 Agentic RAG 生产落地的关键工程问题。
3. ParliamentRAG: Authority-Aware Multi-View RAG
- 来源: arXiv:2608.13410v1(2026-08-13)
- 作者: Tritella, Pozzi, Palmonari(意大利布雷西亚大学)
- 标签:
ragbenchmarksystems - 亮点: 议会记录多视图 RAG,解决三大风险:高频说话者主导、话题专家权重缺失、政治敏感文本引用归属错误。核心是话题相关权威性模型(topic-dependent authority model)。
- 启示: RAG 中 speaker authority 建模是结构化知识检索的新方向。
4. The AI Agents Stack (2026 Edition)
- 来源: The AI Engineer Substack(2026-03)
- 亮点: Agent 技术栈与 LLM 推理栈的本质差异:Agent 需要跨多步执行的状态管理、协议化工具访问、跨会话持久记忆、自主推理循环和实时 guardrails。Guardrails 范畴已从输入/输出过滤扩展到工具调用授权、限速和执行验证。
- 链接: https://theaiengineer.substack.com/p/the-ai-agents-stack-2026-edition
- 启示: 2026 年 Agent 基础设施层正在快速专业化,guardrails 成为独立工程方向。
📋 完整候选列表(8 条)
| # | 标题 | 来源 | 标签 | 亮点 |
|---|---|---|---|---|
| 1 | Maglev: Sliding Recurrent Memory | HF · arXiv:2608.02870 | rag memory |
固定记忆循环 Transformer,可并行训练,泛化滑动窗口 |
| 2 | ParliamentRAG: Authority-Aware Multi-View RAG | arXiv:2608.13410 | rag benchmark |
议会记录多视图 RAG,话题权威性建模 |
| 3 | When Should Multi-Round RAG Stop? | arXiv:2608.13237 | rag benchmark |
Search-R1 停止判断,序贯选择问题 |
| 4 | Spec-First AI Coding Agent (189 files / 717k LOC) | arXiv:2608.12440 | agent systems |
大规模架构重构案例,规格优先协议 |
| 5 | Thought-Level Beam Search for Reasoning | HF · arXiv:2608.08020 | memory systems |
测试时计算分配,约束推理问题 |
| 6 | Hybrid-Policy Self-Editing for Unstructured KE | HF · arXiv:2608.11660 | research |
自由形式知识编辑,UKE 新范式 |
| 7 | Context-Matched Distillation (Video) | HF · arXiv:2608.13391 | multimodal systems |
因果蒸馏,Few-step 视频生成 |
| 8 | Low-Frequency Safety Risks in LALMs | HF · arXiv:2608.09158 | benchmark |
音频模型低频安全红队 |
📡 Substack 线索
The AI Agents Stack (2026 Edition) — The AI Engineer - Agent 技术栈 vs LLM 技术栈的本质差异;guardrails 从 IO 过滤演化为工具授权与执行验证 - 链接: https://theaiengineer.substack.com/p/the-ai-agents-stack-2026-edition
备注
- 本轮使用 Substack(1 条)
- 本轮未使用 CSDN(无源码/复现/排障线索)
- 与 2026-08-15 雷达去重后保留全部 8 条(今日候选无重复)
- 轻量模式 · 10 分钟内完成