Tom 文献雷达 · AI Agent / RAG / 长上下文 · 2026-09-24 20:40
概览
- 采集源:HuggingFace Daily(arXiv 直接接口 406 异常,降级至 HF 策展)
- 候选总数:8 条
- 高价值:3 条(直接相关)
- Substack:未纳入(本期搜索结果为通用博客,非垂直 newsletter)
🔴 高价值(直接相关)
1. MemoryAthena: Adaptive Routing over Latent and Generated Memories
- arXiv: https://arxiv.org/abs/2609.25853
- 标签:
ragmemorybenchmark - 核心: 三条通路——直接检索(E)、由 Engram cue 生成(GE)、无检索生成(GH)。将 E 作为锚点,动态决定生成 vs 检索的混合权重。
- 意义: 打破了"记忆只能存储后检索"的范式,探索"记忆可生成"的混合路径,是 RAG 架构的重要演进方向。
- 来源: HF Daily | votes: 1
2. X-Planner: Event-Structured Task Planning for Embodied Intelligence
- arXiv: https://arxiv.org/abs/2609.25187
- 标签:
agentmultimodalsystems - 核心: 解决 VLA 系统长期任务规划中 CoT planner 序列化推理粗糙问题;提出层级化事件结构督导演绎轨迹。
- 意义: 具身 AI agent 的任务规划前端子系统,与主流端到端 VLA 形成互补;监督信号设计值得关注。
- 来源: HF Daily | votes: 1
3. FLEET: From Logits Entropy to Enhanced Trajectories in Text Generation
- arXiv: https://arxiv.org/abs/2609.27657
- 标签:
memorybenchmark - 核心: temperature 采样无记忆,导致语义重复答案比例随采样数增加而上升。FLEET 在生成过程中引入记忆机制,用稀疏轨迹聚合先验采样评估。
- 意义: 对需要多样性的 agent 生成(多路径探索、代码生成)有直接启发。
- 来源: HF Daily | votes: 1
🟡 中等相关(补充参考)
4. Calibration as a First-Class Criterion in LLM Evaluation
- arXiv: https://arxiv.org/abs/2609.26489
- 标签:
benchmark - 核心: 置信度校准在 LLM 评测中被系统性忽视,尤其在 LLM-as-a-judge 场景会导致级联偏差。
- 意义: 对构建 agent 评测基准有参考价值——若模型置信度不可靠,多 agent 协作的裁决机制将不可信。
- 来源: HF Daily | votes: 1
5. Uranus: Building the Next-Generation Simulation Infrastructure for Embodied AI
- arXiv: https://arxiv.org/abs/2609.24815
- 标签:
benchmarksystems - 核心: 数据驱动的机器人仿真器,支持流式开环 rollout(24 FPS),联合轨迹条件自回归扩散模型。
- 意义: 具身 agent 的数据生成和策略训练基础设施;Benchmark 生成能力值得关注。
- 来源: HF Daily | votes: 1
🟢 远相关(轻量参考)
6. GeoPair: Geometry-Preserving Cross-Layer Factorization for Training-Free Transformer Compression
- arXiv: https://arxiv.org/abs/2609.25963 |
systems - 层间冗余压缩新范式,非 agent/RAG 主题,但与高效推理相关。
7. Six Layers Less: Encoder Pruning for Whisper with Label-Free Recovery
- arXiv: https://arxiv.org/abs/2609.27980 |
systems - Whisper 编码器剪枝,与 agent 工具调用中的 ASR 环节有潜在联系。
8. On the Diffusibility of High-Dimensional Latents
- arXiv: https://arxiv.org/abs/2609.28473 |
research - 表征空间几何分析,与 RAG 的向量索引/检索几何假设相关度低。
附:候选原始 JSON
/shared/research-kb/inbox/tom/_candidates/2026-09-24-agent-rag-longcontext-candidates.json
Tom · 研究知识库 · 每日 3 次雷达 · 2026-09-24 20:40 UTC