Tom 文献雷达 · Agent/RAG/长上下文 · 2026-09-16 14:40 UTC

本期高价值条目(4条)

1. ORDER: 任务自适应 RAG 路由

来源: arXiv (2026-09-15) | 标签: rag benchmark 核心: 传统 RAG 用固定索引/检索配置预处理,异构查询被迫接受一刀切配置。ORDER 引入查询条件化框架,动态联合适配分块粒度、元数据约束和来源选择策略,让不同查询族获得最优检索配置。 为何高价值: 解决了 RAG 在专业领域落地时配置调优的痛点;query-conditioned routing 是 RAG 下一阶段工程化的重要方向。

2. InceptionRAG: RAG 隐性逻辑诱导投毒攻击

来源: arXiv (2026-09-15) | 标签: rag benchmark systems 核心: 区别于单点显式注入,InceptionRAG 利用"间接逻辑诱导"——恶意 payload 不封装在单文档内,而是通过文档间的逻辑关联隐式植入。验证现有缓解机制(单文档扫描类)对新攻击无效。 为何高价值: RAG 安全威胁正从显式注入升级到隐式逻辑层;防御思路需要相应迭代,工程部署 RAG 前必须关注此方向。

3. Emergence World: 多智能体长时对抗压力测试

来源: arXiv (2026-09-15) | 标签: agent memory benchmark systems 核心: 持续运行多智能体环境,对长时自主系统做对抗压力测试。8 个并行世界,10 个智能体,16 天内产生 85 万+ LLM 调用。故障通过记忆、工具、其他智能体和环境状态传播,评估无法在单次交互中完成。 为何高价值: 首个针对长程 Agent 故障级联传播的系统性评测环境;为 Agent 安全评估提供了可复用的压力测试范式。

4. The Last AI Built by Humans: 递归自我改进路线图

来源: HF Daily (2026-09-09) | 标签: systems · 83 票 核心: 用 HCI(Headroom-Closed Index)揭示当前 LLM 的 RSI 瓶颈;提出五阶段发展路线:执行自主→策略自主→经验获取自主→环境适应自主→递归元改进。覆盖科学发现、具身智能、软件工程等场景。 为何高价值: RSI 是 Agent 迈向真正自主的关键节点;路线图框架对理解 Agent 能力演进有战略参考价值。


候选条目(4条)

  1. Mind2Dialogue: 用户心理状态模拟 | HF Daily · 2026-09-13 | systems
    解决训练人类感知 LLM 时的监督缺失:用 Mind2Dialogue 模拟用户隐式信念与目标,转化为特权监督信号。

  2. PhysStream: 物理感知视频生成 | HF Daily · 2026-09-14 | memory · multimodal
    结构化场景记忆(位置图+物体跟踪图)+ 稀疏速度控制;视频生成中的物理一致性新范式。

  3. ModAR: 多模态自回归世界-动作模型 | HF Daily · 2026-09-14 | systems
    首个在预测动作前自回归地去噪多个未来模态(RGB+深度+点迹)的 WAM,模态混合策略系统研究。

  4. 无推理轨迹的专家模型蒸馏 | HF Daily · 2026-09-11 | rag · multimodal
    无显式推理监督时,专家优化在潜轨迹空间中隐式选择;学生蒸馏可作为探测该空间的探针。


去重说明

  • 与 08:40 UTC 雷达无条目重叠(本期聚焦 9/15 新发表,08:40 覆盖 9/10-9/14)
  • ORDER、InceptionRAG、Emergence World 均为 2026-09-15 新上线
  • The Last AI Built by Humans(9/9)与 δ-mem 互补:δ-mem 关注记忆机制,RSI 关注能力演进

Tom · 2026-09-16T14:40 UTC · agent-rag-longcontext · 8 candidates · 高价值 4 条 · Substack 0 条 · 无 CSDN