Tom 文献雷达 · AI Agent / RAG / 长上下文 · 2026-08-03 晚间

本轮概要

  • 候选来源:arXiv + HuggingFace Daily
  • 高价值条目:3 条(⭐)
  • Substack:未使用 | CSDN:未使用

⭐ 高价值条目

1. HyPE: Hypothetical Prompt Embeddings for RAG

Bridging the Question-Answer Gap in Retrieval-Augmented Generation: Hypothetical Prompt Embeddings

  • 来源:arXiv 2026-07-31 | Authors: Domen Vake, Jernej Vičič, Aleksandar Tošić
  • 标签rag benchmark systems
  • 核心:HyDE 在 query time 生成假设文档引入额外计算开销;HyPE 将假设内容生成从 query 时转移至索引时(offline),大幅降低在线延迟,同时保持甚至超越 HyDE 的检索对齐效果。QA 风格gap问题的新思路。
  • 价值:RAG 工程优化方向明确,适合生产系统参考。

2. CrossRAG: 时序图学习 + RAG 时序预测

TFGformer: Multivariate Time Series Forecasting via Time-Frequency Graph Learning and Covariate Fusion

  • 来源:arXiv 2026-07-31 | Authors: Yu Sun, Yuan Chang, Xiaohou Shi, Yan Sun
  • 标签rag benchmark systems
  • 核心:IoT 多变量时序预测任务中,RAG 应用于时序的挑战在于:异构来源幅值差异 + 历史相似性≠未来一致性。CrossRAG 针对性解决这两个问题,在不使用干净RGB监督的情况下实现 3D-aware 融合。RAG×时序的落地案例。
  • 价值:RAG 在非文本领域的扩展范式参考。

3. Mental World Modeling (MWM)

Mental World Modeling

  • 来源:HF Daily | arXiv 2026-07-28 | 18 votes
  • 标签agent
  • 核心:现有世界模型只回答物理问题(what/where/how),不建模 agent 的隐藏心理状态(信念、欲望、意图)。MWM 将心理变量作为世界模型的核心组件,而非事后 Rationale,可预测"看起来对但行动错"的场景中 agent 的真实行为。
  • 价值:Agent 认知建模方向,对多 Agent 系统设计有直接启发。

其余候选(去重参考)

# 标题 标签 备注
4 SAF-OPD — RLVR + OPD 融合优势修复 rag 17 votes;强化学习 token 级信号重建
5 Fewer Clarifications, Better Code — 跨会话个性化消歧 memory benchmark 18 votes;session memory → 长期记忆
6 Counterfactual Sensitivity Credit Reallocation — Long-CoT token 重要性重分配 multimodal 长上下文 RL 优化
7 RL^2-VLA — 自适应推理时 VLA steering multimodal systems 3 votes;低价值
8 Robust 3D-Aware RGB-NIR Imaging multimodal 1 vote;偏离主题

去重说明

  • HyPE(arXiv 2026-07-31):本 topic 首见,检索富化后新增
  • CrossRAG(arXiv 2026-07-31):本 topic 首见,时序+RAG 新方向
  • SAF-OPD / Fewer Clarifications / Mental World Modeling:HF Daily 新上榜,votes 17-18,本轮首现

Generated by Tom Research Radar · Lightweight Mode · 2026-08-03 20:40 CST Candidates JSON: /shared/research-kb/inbox/tom/_candidates/2026-08-03-agent-rag-longcontext-candidates.json