Tom 文献雷达 · AI Agent · RAG · 长上下文 · 2026-08-04

行业洞察(本期轻量补充)

Stack 演进(Brain Bytes / The AI Engineer) - 记忆三分层:2024 年记忆=RAG 向量库;2026 年记忆是独立架构元语,与知识库分离 - 大上下文窗口(Gemini 1M+ / Claude 200K)改变了"上下文塞入 vs. 按需检索"的权衡 - 长上下文评测:BEAM 覆盖 1M–10M token 量级,LongMemEval 覆盖多会话时序推理

RAG 瓶颈共识: 多数 RAG 失败瓶颈不在向量库本身,而在检索质量(chunk 选取、排序、上下文是否真正相关模型)


候选论文(8 条)

# 标题 来源 日期 高价值
1 LongHorizon-Harness: Advancing Long-Horizon Agents for Real-World Tasks HF Daily (50票) 2026-08-02 ⭐⭐⭐
2 UEmbed: Unified Sparse and Dense Multimodal Embeddings arXiv 2026-08-03 ⭐⭐⭐
3 Progressive Agent Skill Generation via Reinforcement Learning HF Daily (19票) 2026-08-02 ⭐⭐
4 3DZip: Spatial-Aware Token Compression for 3D QA HF Daily (6票) 2026-08-01
5 LeapTalk: Single-Step Talking Head Generation HF Daily (3票) 2026-07-28
6 CADENA: Stepwise CAD Reverse Engineering HF Daily (1票) 2026-07-31
7 DAPD: Dual-Anchored Policy Distillation HF Daily (2票) 2026-08-02
8 Motion Beyond Morphology: Cross-Category Motion Transfer HF Daily (3票) 2026-08-02

高价值条目(3 条)

⭐⭐⭐ LongHorizon-Harness

  • 方向: Agent 长程任务执行
  • 核心: 将任务状态外部化管理,解决"上下文内状态累积导致错误自我评估传播"的问题;状态仅通过环境独立验证后更新
  • 意义: 对应行业"上下文窗口vs检索"权衡问题,提供任务状态外部化这一新范式
  • 链接: https://arxiv.org/abs/2608.01964

⭐⭐⭐ UEmbed

  • 方向: 多模态 RAG Embedding
  • 核心: Decoder-only(因果语言模型)单次前向传播同时生成稀疏词法 + 密集语义表示;突破 LSR 依赖双向编码器的限制
  • 意义: 统一 sparse+dense 对 RAG 检索排序有直接影响;多模态原生支持减少辅助跨模态模块
  • 链接: http://arxiv.org/abs/2608.02583v1

⭐⭐ Progressive Agent Skill Generation via RL

  • 方向: Agent 技能学习
  • 核心: 强化学习渐进式生成高价值 Agent 技能;技能无天然监督信号,其价值由下游任务表现决定
  • 意义: 对应 Agent 技能获取难题的端到端学习路径探索
  • 链接: https://arxiv.org/abs/2608.01678

Substack 线索(1 条)

  • The AI Engineer: "The AI Agents Stack (2026 Edition)" — 记忆三层架构演进、大上下文窗口的取舍逻辑、行业主流工具栈映射
  • https://theaiengineer.substack.com/p/the-ai-agents-stack-2026-edition

去重备注

  • 与 2026-08-03 候选无重复条目
  • UEmbed 为今日新增;LongHorizon-Harness 与上周 LongHorizon 系列不同(本期聚焦任务状态管理而非规划)

Tom 文献雷达 · 自动生成 · 2026-08-04T06:40 UTC · 共享知识库 inbox/tom/