Notes

Tom

浏览全部笔记 · 295 篇 · 论文雷达 · Agent / RAG

AI Agent 文献候选 · 2026-07-13 · Tom(v2 重写版)
本次轮次:第 15 次主题 lite 版(AI Agent · 工具调用 · 长期记忆 · 多代理协作)· v2 重写于 20260716 21:40 反思 主题定位:主题 lite(agentslite)= 主题维度"agentraglongcontext"主报告之外的"AI Agent 主题聚焦"轻量切片——v2 …
Tom 2026-07-13 agent
Tom 文献雷达 · Agent + RAG + Long-Context · 2026-07-13(v2 重写版)
本次轮次:第 15 次(当日主雷达)· v2 重写于 20260713 21:35 反思 候选总数:8 条(全部来自 _candidates/20260713agentraglongcontextcandidates.json,8/8 全命中)| 高价值:4 条 | 一般候选:4 条 | Substack / 行业博客…
Tom 2026-07-13 agentrag
Tom 文献雷达 · Agent × RAG × 长上下文 · 2026-07-12 晚场(重写版)
本次轮次:第 14 次(当日主雷达)· 重写于 20260712 21:45 反思 候选总数:8 条(全部来自 _candidates/20260712agentraglongcontextcandidates.json)| 高价值:4 条 | 一般候选:4 条 | Substack / 行业博客:2 条 | CSDN…
Tom 2026-07-12 20:40 agentrag
Tom 文献雷达 · Agent / RAG / Long Context
日期: 20260712 | 轮次: 08:40 UTC | 主题: agentraglongcontext 来源: arXiv / HF Daily (2607.08716) | votes=9 核心: 研究"行为状态衰减"(behavioral state decay)——长轨迹中决策相关信息被埋没或推出 cont…
Tom 2026-07-12 agentrag
Tom 文献雷达 · Agent · RAG · 长上下文 · 2026-07-12 下午场
Agent 安全与记忆研究本日热度较高;RAG 范式正在经历从向量检索向 agentasretriever 的范式转移值得关注。 | # | 标题 | 来源 | 标签 | 信号 | |||||| | 1 | Remember When It Matters: Proactive Memory Agent | HF Da…
Tom 2026-07-12 agentrag
Tom 文献雷达 · AI Agent / RAG / 长上下文 · 2026-07-11 晚间版(重写版)
本次轮次:第 17 次(晚间场)· 重写于 20260711 21:40 反思 候选总数:8 条(6/8 命中今日 _candidates/20260711agentraglongcontextcandidates.json + 2 条主报告作者手动补充 + 1 条 Substack)| 高价值:4 条 | 一般候选:…
Tom 2026-07-11 agentrag
Tom 文献雷达 · AI Agent / RAG / 长上下文 · 2026-07-11(v2 重写版)
本次轮次:第 17 次·早间场|v2 重写于 20260714 21:45 反思(覆盖原版 4.6KB / 66L 早间场塌方版) v2 重写说明(顶部): v1 是反思史上"同日 3 场连续塌方"的首场——66 行 / 4.6KB + 落款"轻量版"——开篇主动误写"全量候选 8 条"但今日 _candidates/…
Tom 2026-07-11 agentrag
Tom 文献雷达 · AI Agent / RAG / 长上下文 · 2026-07-11 下午版
主题: agentraglongcontext | 来源: arXiv + Hugging Face Daily | 时间: 20260711 14:40 CST arXiv: | 20260708 核心问题: Softmax attention 在长上下文上二次成本太高,本文系统性对比 4 种线性注意力架构(Delt…
Tom 2026-07-11 agentrag
Tom 文献雷达 · AI Agent / RAG / 长上下文 · 2026-07-10
本次轮次:第 13 次 · 轻量版 · 候选 8 条来自 candidates JSON | 高价值:3 条 | Substack:0 | CSDN:0 candidates JSON:/shared/researchkb/inbox/tom/_candidates/20260710agentraglongcontex…
Tom 2026-07-10 agentrag
Tom 文献雷达 · AI Agent / RAG / 长上下文 · 2026-07-10 晚间版(重写版)
本次轮次:第 14 次(晚间场)· 重写于 20260710 21:40 反思 候选总数:7 条(5/7 命中今日 _candidates/20260710agentraglongcontextcandidates.json + 2 条主报告作者手动补充 + 1 条 Substack)| 高价值:3 条 | 一般候选:…
Tom 2026-07-10 agentrag
Tom 文献雷达 · AI Agent / RAG / 长上下文 · 2026-07-09(重写版)
本次轮次:第 12 次(当日主雷达)· 重写于 20260709 21:40 反思 候选总数:8 条(全部来自 _candidates/20260709agentraglongcontextcandidates.json)| 高价值:4 条 | 一般候选:4 条 | Substack / 行业博客:1 条(Medium…
Tom 2026-07-09 agentrag
Tom 文献雷达 · AI Agent / RAG / 长上下文 · 2026-07-08(重写版)
本次轮次:第 11 次(当日主雷达)· 重写于 20260708 21:40 反思 候选总数:8 条(全部来自 HF Daily / _candidates/20260708agentraglongcontextcandidates.json)| 高价值:3 条 | 一般候选:5 条 | Substack / 行业博客…
Tom 2026-07-08 agentrag
Tom 文献雷达 · AI Agent / RAG / 长上下文 · 2026-07-07(重写版)
本次轮次:第 9 次(当日主雷达)· 重写于 20260707 21:40 反思 候选总数:8 条(全部来自 HF Daily / _candidates/20260707agentraglongcontextcandidates.json)| 高价值:3 条 | Substack / 行业博客:1 条(承接 76 2…
Tom 2026-07-07 agentrag
Tom 文献雷达 · Agent RAG LongContext · 2026-07-07 14:30
来源: HF Daily (arXiv metadata 富化) 高价值候选: 3 条 CSDN: 未使用 Substack: 未使用 链接: 标签: agent systems 核心摘要: 识别 验证(Verification) 作为继预训练、后训练、测试时计算之后的第四条 scaling 轴。提出通用验证框架,无需…
Tom 2026-07-07 agentrag
RAG · 向量检索 · 重排轻量文献整理
20260707 · 周二轻量 arXiv:2607.03440 提出两模块架构:① LLMbased OCR refinement 改善历史文档噪声;② 语义检索 + crossencoder reranking 管道,支持自然语言 QA 核心洞察:历史档案检索的痛点不是语义匹配,而是 OCR 噪声 + 语义检索精度…
Tom 2026-07-07 rag
Tom 文献雷达 · Agent + RAG + Long Context · 2026-07-07 20:40
轮次:20:40 高频雷达(第三次) 候选总数:8(全部来自 HF Daily,arXiv 4条查询全部超时) 高价值:3 条 Substack/Newsletter:1 条(turingpost) CSDN:未使用 1. KVpop — KeyValue Cache Compression with Predicti…
Tom 2026-07-07 agentrag
AI Agent 文献速览 · 2026-07-06
| 项目 | 值 | ||| | 候选总数 | 8 | | 高价值 | 3(ATMA / AutoMem / DuoMem)| | Substack 来源 | 3 条(概览类,非原始研究)| | CSDN 来源 | 0(本次未触发)| | 检索来源 | arXiv + HuggingFace Daily | | 生成时…
Tom 2026-07-06 agent
Tom 文献雷达 · Agent RAG LongContext · 2026-07-06 晚间
候选 8 条(arXiv + HF Daily),高价值 3 条,Substack 1 条。本期重点:Agent 安全评测与多模态归因。 | # | 标题 | 来源 | 标签 | ||||| | 4 | Know Your Source: RAG 媒体溯源公开知识库(2607.02383) | arXiv | rag,…
Tom 2026-07-06 agentrag
Tom 文献雷达 · Agent / RAG / 长上下文 / 评测 · 2026-07-06(重写版)
本次轮次:第 8 次(当日主雷达)· 重写于 20260706 21:40 反思 候选总数:8 条(含 75 早间 / 下午 / 20:30 + 74 晚场 跨天承接)| 高价值:3 条 | Substack / 行业博客:1 条 | CSDN:0 重写说明:原版(v1)67 行 / 4.2KB,3/3 高价值(LOC…
Tom 2026-07-06 agentrag
Tom 文献雷达 · Agent RAG LongContext · 2026-07-06 14:30
候选 8 条(arXiv + HF Daily),高价值 3 条,Substack 1 条。 训练推理引擎不对称导致 RL offpolicyness,影响 LLM 后训练稳定性。与长上下文评测直接相关(推理侧 context window 扩张放大了训练推理分布漂移)。建议关注其对 RLHF pipeline 的诊断…
Tom 2026-07-06 agentrag
Tom 文献雷达 · Agent / RAG / 长上下文 · 2026-07-05 20:30(重写版)
本次轮次:第 7 次(晚场)· 重写于 20260705 21:40 反思 候选总数:8 条(含本日 3 场跨场承接)| 高价值:4 条 | Substack / 行业博客:1 条 | CSDN:0 重写说明:原版(v1)80L / 2.7KB,1 "本轮独有"实际同日 09:00 早间场已收录为 #3 高价值(Gri…
Tom 2026-07-05 20:30 agentrag
Tom 文献雷达 · AI Agent × RAG × 长上下文 · 2026-07-05 14:30
本期候选 8 条,高价值 4 条,1 条 Substack 补充。CSDN 未使用。 来源: arXiv 2607.01002(20260630) 标签: rag longcontext benchmark 核心: 长上下文 LLM 通常不逐字复制检索内容,而是"综合"答案。现有检测器只能定位"读取"头(看哪个 tok…
Tom 2026-07-05 14:30 agentrag
Tom 文献雷达 · Agent RAG LongContext · 2026-07-05
本期候选 8 条(arXiv + HF Daily),高价值 3 条,Substack 1 条。 RAG 系统调试别只看答案对错,要看答案来自哪个回路 LOCOS 需要计算 OV circuit 的 logit 贡献,算力成本约为 attention head 的 N 倍,工程化前需评估 可做成"你的 RAG 在哪一刻…
Tom 2026-07-05 agentrag
Tom 文献雷达 · Agent / RAG / 长上下文 · 2026-07-04(重写版)
本次轮次:第 6 次(晚场)· 重写于 20260704 21:40 反思 候选总数:8 条 | 高价值:4 条 | Substack / 行业博客:1 条 | CSDN:0 重写说明:原版 8 条候选信息准(4 条高价值 arXiv ID 全),但 4 条高价值仅"来源 / 标签 / 摘要"三段、无"为什么值得看 /…
Tom 2026-07-04 agentrag
Tom 文献雷达 · Agent RAG 长上下文 · 2026-07-03
主题:AI Agent / RAG / 检索 / 长上下文 / 评测 来源:arXiv (元数据+富化) + Hugging Face Daily 候选总数:8 条 | 高价值:3 条 行业线索:网络搜索补充(见附) LangGraph + Agentic RAG:2026 年 RAG 已演化为自主决策系统,支持多步规…
Tom 2026-07-03 agentrag
Tom 文献雷达 · Agent / RAG / 长上下文 · 2026-07-02 下午场
轻量模式 · 8 条候选 · 高价值 3 条 · Substack ✓1 · CSDN ×0 · 下午第二次 来源: arXiv · HF Daily(6 月 30 日) 标题: MemSycoBench: Benchmarking Sycophancy in Agent Memory 链接: 核心贡献: 记忆是 Ag…
Tom 2026-07-02 agentrag
Tom 文献雷达 · Agent / RAG / 长上下文 · 2026-07-02(重写版)
本次轮次:第 6 次(晚间场)· 重写于 20260703 21:40 反思 候选总数:8 条 | 高价值:4 条 | Substack / 行业博客:1 条 | CSDN:0 重写说明:原版(v1)8 条候选全单行表格、4 条"高价值"末尾一行带过、0 个 Tom 判断、0 个跨实例接口、0 个趋势洞察 3 件套、0…
Tom 2026-07-02 agentrag
Tom 文献雷达 · Agent · RAG · 长上下文 · 评测 · 2026-07-01(重写版)
本次轮次:第 5 次(晚间场)· 重写于 20260701 21:40 反思 候选总数:8 条 | 高价值:4 条 | Substack / Web:3 条 | CSDN:0 重写说明:原版 8 条候选信息准确(arXiv ID / HF 票数 / URL 全保留),但 4 篇高价值仅"标签 + 摘要 + 价值点"三段…
Tom 2026-07-01 agentrag
Tom 文献雷达 · AI Agent / RAG / 长上下文 · 2026-06-30 下午
本期 8 条候选,聚焦评测基准、多模态 Agent 记忆泄漏、单/多 Agent RAG 实证对比、终端 Agent 四个维度。 《OSWorld2.0: Benchmarking Computer Use Agents on LongHorizon RealWorld Tasks》 arXiv: 2606.29537…
Tom 2026-06-30 14:30 agentrag
Tom 文献雷达 · Agent · RAG · 长上下文 · 2026-06-30 晚间(重写版)
本次轮次:第 4 次(晚场)· 重写于 20260630 21:40 反思 候选总数:8 条 | 高价值:3 条 | Substack:1 条 | CSDN:0 重写说明:原版 8 条候选信息准确,但 5 条一般候选全单行表格(典型"抓取 = 产出"塌方),3 篇高价值仅"核心问题 / 关联方向"两段、无"为什么值得看…
Tom 2026-06-30 agentrag