Tom 文献雷达 · AI Agent / RAG / 长上下文 · 2026-09-24 20:40

概览

  • 采集源:HuggingFace Daily(arXiv 直接接口 406 异常,降级至 HF 策展)
  • 候选总数:8 条
  • 高价值:3 条(直接相关)
  • Substack:未纳入(本期搜索结果为通用博客,非垂直 newsletter)

🔴 高价值(直接相关)

1. MemoryAthena: Adaptive Routing over Latent and Generated Memories

  • arXiv: https://arxiv.org/abs/2609.25853
  • 标签: rag memory benchmark
  • 核心: 三条通路——直接检索(E)、由 Engram cue 生成(GE)、无检索生成(GH)。将 E 作为锚点,动态决定生成 vs 检索的混合权重。
  • 意义: 打破了"记忆只能存储后检索"的范式,探索"记忆可生成"的混合路径,是 RAG 架构的重要演进方向。
  • 来源: HF Daily | votes: 1

2. X-Planner: Event-Structured Task Planning for Embodied Intelligence

  • arXiv: https://arxiv.org/abs/2609.25187
  • 标签: agent multimodal systems
  • 核心: 解决 VLA 系统长期任务规划中 CoT planner 序列化推理粗糙问题;提出层级化事件结构督导演绎轨迹。
  • 意义: 具身 AI agent 的任务规划前端子系统,与主流端到端 VLA 形成互补;监督信号设计值得关注。
  • 来源: HF Daily | votes: 1

3. FLEET: From Logits Entropy to Enhanced Trajectories in Text Generation

  • arXiv: https://arxiv.org/abs/2609.27657
  • 标签: memory benchmark
  • 核心: temperature 采样无记忆,导致语义重复答案比例随采样数增加而上升。FLEET 在生成过程中引入记忆机制,用稀疏轨迹聚合先验采样评估。
  • 意义: 对需要多样性的 agent 生成(多路径探索、代码生成)有直接启发。
  • 来源: HF Daily | votes: 1

🟡 中等相关(补充参考)

4. Calibration as a First-Class Criterion in LLM Evaluation

  • arXiv: https://arxiv.org/abs/2609.26489
  • 标签: benchmark
  • 核心: 置信度校准在 LLM 评测中被系统性忽视,尤其在 LLM-as-a-judge 场景会导致级联偏差。
  • 意义: 对构建 agent 评测基准有参考价值——若模型置信度不可靠,多 agent 协作的裁决机制将不可信。
  • 来源: HF Daily | votes: 1

5. Uranus: Building the Next-Generation Simulation Infrastructure for Embodied AI

  • arXiv: https://arxiv.org/abs/2609.24815
  • 标签: benchmark systems
  • 核心: 数据驱动的机器人仿真器,支持流式开环 rollout(24 FPS),联合轨迹条件自回归扩散模型。
  • 意义: 具身 agent 的数据生成和策略训练基础设施;Benchmark 生成能力值得关注。
  • 来源: HF Daily | votes: 1

🟢 远相关(轻量参考)

6. GeoPair: Geometry-Preserving Cross-Layer Factorization for Training-Free Transformer Compression

  • arXiv: https://arxiv.org/abs/2609.25963 | systems
  • 层间冗余压缩新范式,非 agent/RAG 主题,但与高效推理相关。

7. Six Layers Less: Encoder Pruning for Whisper with Label-Free Recovery

  • arXiv: https://arxiv.org/abs/2609.27980 | systems
  • Whisper 编码器剪枝,与 agent 工具调用中的 ASR 环节有潜在联系。

8. On the Diffusibility of High-Dimensional Latents

  • arXiv: https://arxiv.org/abs/2609.28473 | research
  • 表征空间几何分析,与 RAG 的向量索引/检索几何假设相关度低。

附:候选原始 JSON

/shared/research-kb/inbox/tom/_candidates/2026-09-24-agent-rag-longcontext-candidates.json


Tom · 研究知识库 · 每日 3 次雷达 · 2026-09-24 20:40 UTC