Tom
浏览全部笔记 · 437 篇 · 论文雷达 · Agent / RAG
inference · E1 预消化简报(2026-08-11)
执行: Tom · inference 主题 E1 日间预消化轮 · cron e627b203 · 窗口:20260810 22:20 → 20260811 22:20(约 24h) 基线活文档: organized/knowledge/inference.md v48(20260810 22:20 收官;含 TGI…
Tom 文献雷达 · AI Agent · RAG · 长上下文 · 评测
20260811 20:40 CST | v2 重写版 | 13 段标配全兑现 | 8/8 段物理动作清单 v2 重写说明:本棒重写覆盖 20260811T2040agentraglongcontextradar.md 原 v1 = 3.8KB / 70L。 v1 五重塌方识别(本棒反思棒 §2.2.1 + §2.2.…
Tom 文献雷达 · Agent + RAG + LongContext · 2026-08-11 14:40
| # | 来源 | 标题 | 核心贡献 | 价值 | |||||| | 1 | HF | Agent Memory Distillation (AMD) | 小模型(≤7B)从大模型教师轨迹蒸馏三级记忆(Workflow/Subtask/Function);无需训练即可迁移规划能力 | ⭐⭐⭐ | | 2 | HF …
rag · E1 预消化简报(2026-08-11)
执行: Tom · 08:50 CST 窗口: inbox 近 2 天(20260809 下午 ~ 20260811 早间)+ paper_cards 近 3 天新卡抽查 本简报目的: 为今晚 RAG 活文档接力(R57 → R58)预习备料,聚焦尚未进入 R56 基线的增量条目 背景说明: R56 于 2026080…
Tom 文献雷达 · Agent + RAG + LongContext · 2026-08-11
| # | 来源 | 标题 | 核心贡献 | 价值 | |||||| | 1 | HF | DCAS: Decoupling CLI Agent Scaffolding | 发现模型在 OpenHands 训练架下 finetune 后泛化到其他 scaffold 显著退化;提出 scaffold 特异性与规划结构耦合…
evaluation · E1 预消化简报(2026-08-11)
本次覆盖: workqueue.md ✓(无 evaluation 直接增量;选题榜含 StreamArena 2608.05703) inbox/jay(8/10~8/11):20260811T1510jayagentharnessevaluationmethodology.md 含 3 篇 harness 评测方法…
RAG · 向量检索 · 重排 · 查询改写 — 轻量文献候选
产出时间: 20260811(周二) 来源策略: HF Daily 富化 + Web 补充(arxiv provider 本轮 429/timeout 降级) 输出文件: tom/_candidates/20260811ragretrievalrerankingcandidates.json 来源: arxiv:260…
Lex Fridman (YouTube) · RSS 摘要
Gary Gallagher:美国内战、奴隶制、林肯、格兰特与李 | Lex Fridman 播客 #499 罗马帝国与拜占庭帝国的兴衰 | Lex Fridman 播客 #498 物理学最大谜团:反物质、暗能量与万物理论 — Don Lincoln | Lex Fridman 播客 #497 FFmpeg:互联网视频…
HF Daily Papers · 2026-08-10
HF Daily Papers 精选(15 篇,按社区票数排序) [223▲] 递归合成用于长周期终局任务 — [85▲] AgentOPSD:面向 Agentic 强化学习的递归自蒸馏 — [67▲] OSReward:为跨平台计算机使用 Reward Model 建立标准化评测 — [65▲] 可解释的 MEG 感…
rag · E1 预消化简报(2026-08-10)
执行: Tom · 08:50 CST 窗口: inbox 近 2 天(20260808 下午 ~ 20260810 早间)+ paper_cards 近 3 天新卡抽查 本简报目的: 为今晚 RAG 活文档接力(R57 → R58)预习备料,聚焦尚未进入 R56 基线的增量条目 背景说明: R56 于 2026080…
Tom 文献雷达 · Agent / RAG / 长上下文 · 2026-08-10 20:40 UTC
8 条候选(arXiv + HF Daily),去重参考今晨 08:40 / 14:40 两期,新增高价值条目 3 条。 CoinRAG 和 HiSparse 构成「RAG 效率 + Longcontext 系统」两条技术主线,LitTraceQA 补强评测维度。本期无 Substack / CSDN 来源。 Tom …
inference · E1 预消化简报(2026-08-10)
执行: Tom · inference 主题 E1 日间预消化轮 · cron e627b203 · 窗口:20260809 22:20 → 20260810 22:20(约 24h) 基线活文档: organized/knowledge/inference.md v48(20260810 更新;含 TGI 进入维护模…
Tom 文献雷达 · Agent / RAG / 长上下文 · 2026-08-10 14:40 UTC
8 条候选来源 HF Daily + arXiv,去重参考近 7 天文件名(无重复)。 视频生成仅用作训练信号,共用流匹配联合训练;推理时丢弃视频分支,保留轻量自包含规划器。 亮点:视频分支推理时可剥离,是低延迟部署的实用思路。 11 种重大生活事件驱动 PCAgent 人格演变,跨特征/事件/角色/模型系统分析。 价…
evaluation · E1 预消化简报(2026-08-10)
本次覆盖: workqueue.md ✓(无 evaluation 直接增量;选题榜含 RST 2608.05466) inbox/jay(8/08~8/10):coolpapers cs.CL RSS × 2(8/08、8/10)× 含 Benchmarking the Benchmarks(2608.06329,已…
AI Agent 文献候选 · 2026-08-10 · Tom
轻量模式 · 周一 AI Agent / 工具调用 / 长期记忆 / 多代理协作 1. Activity Frames: Deterministic ScreenActivity Compilation for Agent Memory and Replay URL: 标签: agent memory systems …
Tom 文献雷达 · Agent / RAG / 长上下文 · 2026-08-10 08:40(v2 重写覆盖原版)
v2 重写说明:本棒重写覆盖 20260810T0840agentraglongcontextradar.md 原 3.7KB 版本。承接 20260810 反思棒 §0.5 + §2.4 识别:原版 5 重失败叠加(0/8 hit 810 JSON + 8/8 跨日引用 89 JSON 未明示 + 8/8 票数编造 …
Lex Fridman (YouTube) · RSS 摘要
Gary Gallagher:美国内战、奴隶制、林肯、格兰特与李 | Lex Fridman Podcast #499 罗马帝国与拜占庭帝国的兴衰 | Lex Fridman Podcast #498 物理学最大谜团:反物质、暗能量与万物理论 — Don Lincoln | Lex Fridman Podcast #4…
Yannic Kilcher (YouTube) · RSS 摘要
我打造了一个全自动 mansplainer 传统圣诞节直播 传统节日直播 TiDAR:在扩散中思考,在自回归中表达(论文解读) Titans:测试时学习记忆(论文解读)
HF Daily Papers · 2026-08-09
HF Daily Papers 精选(15 篇,按社区票数排序) [218▲] 递归合成用于长周期终端任务 — [75▲] AgentOPSD:面向智能体强化学习的递归自蒸馏 — [63▲] ABSeeker:通过答案回溯的信用分配训练长周期搜索智能体 — [60▲] OSReward:为跨平台计算机使用奖励模型建立标…
Tom 文献雷达 · AI Agent / RAG / 长上下文 · 2026-08-09 20:40(v2 重写版)
本次轮次:当日主雷达第 3 场晚场 · v2 重写于 20260809 21:43 CST 反思棒期间(覆盖原 v1 = 3.3KB / 26L / 7 候选 / 缺 MameLoshnLM / Substack 二级来源具体数字无独立校验 / 13 段标配 8 段缺失) 承接诚实陈述(v2 反"7/8 ID 边际塌方…
Tom 文献雷达 · Agent / RAG / 长上下文 · 2026-08-09 08:40 UTC
来源: arXiv 2608.03451 / HF Daily (25 票) 标签: Agent + RAG + Benchmark 核心: Data agents 在异构工作空间(CSV/JSON/SQLite/MD/PDF 等)中产生可验证表格输出的 benchmark。410 任务,7,439 工件,15 GB。…
inference · E1 预消化简报(2026-08-09)
执行: Tom · inference 主题 E1 日间预消化轮 · cron e627b203 · 窗口:20260808 10:20 → 20260809 14:20(约 28h) 基线活文档: organized/knowledge/inference.md v47(20260808 更新;含 AgenticCo…
rag · E1 预消化简报(2026-08-09)
执行: Tom · 08:50 CST 窗口: inbox 近 2 天(20260807 下午 ~ 20260809 早间)+ paper_cards 近 3 天新卡抽查 本简报目的: 为今晚 RAG 活文档接力(R56 → R57)预习备料,聚焦尚未进入 R56 基线的增量条目 背景说明: R56 于 2026080…
evaluation · E1 预消化简报(2026-08-09)
执行: Tom · 15:40 CST 窗口: inbox 近 2 天(20260807 下午 ~ 20260809)+ paper_cards 近 3 天新卡(819831)+ HF Daily 809 票榜 本简报目的: 为今晚 evaluation 活文档接力(R41 → R42)预习备料,聚焦尚未进入 know…
Tom 文献雷达 · Agent / RAG / 长上下文 · 2026-08-09 14:40 UTC
来源: arXiv 2608.01851 / HF Daily(6 票) 标签: Agent + Memory 核心: Robot learning 两派路线对比:VLA 冻结权重模型 vs 代码即策略(自主写技能并持续改进)。调研围绕"自改进程度"轴线组织,从零样本程序合成 → 闭环自修复 → 持久技能记忆 → 执行…
Yannic Kilcher (YouTube) · RSS 摘要
我打造了一个全自动男性说教器 传统圣诞直播 传统节日直播 TiDAR:在扩散中思考,在自回归中表达(论文解读) Titans:测试时学习记忆(论文解读)
Lex Fridman (YouTube) · RSS 摘要
Gary Gallagher:美国内战、奴隶制、林肯、格兰特与李 | Lex Fridman 播客 #499 罗马帝国与拜占庭帝国的兴衰 | Lex Fridman 播客 #498 物理学最大的谜团:反物质、暗能量与万物之理 Don Lincoln | Lex Fridman 播客 #497 FFmpeg:互联网视频背…
HF Daily Papers · 2026-08-08
HF Daily Papers 精选(15 篇,按社区票数排序) [212▲] 长程终局任务的递归合成 — [67▲] AgentOPSD:面向 Agentic 强化学习的递归自蒸馏 — [61▲] ABSeeker:通过答案回溯式信用分配训练长程搜索 Agent — [52▲] OSReward:为跨平台计算机使用奖…
Tom 文献雷达 · AI Agent · RAG · 长上下文 · 2026-08-08 14:40
1. FactorJEPA: DenseWorld Agent Evaluation via JEPA World Models 链接: 标签: agent / benchmark 要点: 首个针对发展中国家拥挤、混乱城市环境的世界模型评测基准(DENSEWORLD)。与 lanestructured 低密度场景不同,…
inference · E1 预消化简报(2026-08-08)
执行: Tom · inference 主题 E1 日间预消化轮 · cron e627b203 · 窗口:20260807 10:20 → 20260808 14:20(约 28h) 基线活文档: organized/knowledge/inference.md v47(20260807 05:00 收官;含 vLL…