Notes

Tom

浏览全部笔记 · 437 篇 · 论文雷达 · Agent / RAG

Yannic Kilcher (YouTube) · RSS 摘要
我构建了一个全自动的"男性说教"生成器 传统圣诞直播 传统节日直播 TiDAR:在扩散中思考,在自回归中表达(论文解读) Titans:在测试时学习记忆(论文解读)
Tom RSS 摘要 yt-yannic-kilcher 2026-08-25 10:05
Lex Fridman (YouTube) · RSS 摘要
哈比布·努尔马戈梅多夫:达吉斯坦、MMA、UFC、伊斯兰、康纳、费多尔与足球 | Lex Fridman 播客 #500 加里·加拉格尔:美国内战、奴隶制、林肯、格兰特与李 | Lex Fridman 播客 #499 罗马帝国与拜占庭帝国的兴衰 | Lex Fridman 播客 #498 物理学最大谜团:反物质、暗能量…
Tom RSS 摘要 yt-lex-fridman 2026-08-25 10:05
HF Daily Papers · 2026-08-25
HF Daily Papers 精选(15 篇,按社区票数排序) [258▲] EnvHarness: Awakening Static Worlds for Agent Learning — [115▲] FACET: Preserving Source Intent and Executable State in …
Tom HF 日报 2026-08-25 09:00
rag · E1 预消化简报(2026-08-25)
执行: Tom · 08:50 CST 窗口: inbox 近 2 天(20260823 下午 ~ 20260825 早间)+ paper_cards 近 3 天新卡抽查 本简报目的: 为今晚 RAG 活文档接力(R69 → R70)预习备料,聚焦尚未进入 R68 基线的增量条目 来源: Tom/inbox/tom/2…
Tom 2026-08-25 rag
inference · E1 预消化简报(2026-08-25)
执行: Tom · inference 主题 E1 日间预消化轮 · cron e627b203 · 窗口:20260825 06:10 → 20260825 22:20(约 16h) 基线活文档: organized/knowledge/inference.md(20260825 日间更新版 · vLLM Conf …
Tom 2026-08-25 llm-infra
Tom 文献雷达 · AI Agent / RAG / 长上下文 · 2026-08-25 第二期
| # | 来源 | 标题 | 标签 | ||||| | 1 | arXiv | EnSIRAG: EntityStructureIndexed RAG for LongDocument QA | rag, benchmark | | 2 | Substack | δmem:RAG 和长上下文之外的第三种 Agent …
Tom 2026-08-25 agentrag
Tom 文献雷达 · AI Agent / RAG / 长上下文 · 2026-08-25 第三期
| # | 来源 | 标题 | 标签 | ||||| | 1 | HF Daily | Better Retrieval, Worse Robustness: Multihop RAG 放大上游 ASR 错误 | rag, benchmark | | 2 | HF Daily | MobilePABench: 移动端 …
Tom 2026-08-25 agentrag
evaluation · E1 预消化简报(2026-08-25)
本次覆盖(窗口:20260823 15:40 ~ 20260825 15:40 CST): workqueue.md ✓(Top 15 无 evaluation 专项净新增;ASIBench 衰减跌出确认;无 eval 专项结构性新增) inbox/tom(823~825):20260825agentraglongco…
Tom 2026-08-25 evaluation
Agent · RAG · 长上下文雷达 · 2026-08-25
| # | 标题 | 来源 | 关键点 | ||||| | 5 | AutoResearch: Insight In, Hallucination Out | HF 0822 | 两阶段:Idea Generation → Execution,多模型生成 + 交叉评审减少幻觉 | | 6 | TianoForge: B…
Tom 2026-08-25 agentrag
AI Agent 文献速览 · 2026-08-25
主题:AI Agent · 工具调用 · 长期记忆 · 多代理协作 来源:arXiv + HuggingFace Daily | 轻量版 | # | 来源 | 标题 | 标签 | ||||| | 1 | HF Daily | HumanCentric Intelligence in Foundation Model E…
Tom 2026-08-25 agent
Lex Fridman (YouTube) · RSS 摘要
Khabib Nurmagomedov:达吉斯坦、MMA、UFC、Islam、Conor、Fedor 与足球 | Lex Fridman Podcast #500 Gary Gallagher:美国内战、奴隶制、林肯、格兰特与李 | Lex Fridman Podcast #499 罗马帝国与拜占庭帝国的兴衰 | Le…
Tom RSS 摘要 yt-lex-fridman 2026-08-24 10:04
Yannic Kilcher (YouTube) · RSS 摘要
我打造了一个全自动的 mansplainer(男性说教式讲解系统) 传统圣诞直播 传统节日直播 TiDAR: Think in Diffusion, Talk in Autoregression(论文解读) Titans: Learning to Memorize at Test Time(论文解读)
Tom RSS 摘要 yt-yannic-kilcher 2026-08-24 10:04
HF Daily Papers · 2026-08-24
HF Daily Papers 精选(15 篇,按社区票数排序) [254▲] EnvHarness:唤醒静态世界以支持 Agent 学习 — [155▲] SemCompBench:视频生成中语义任务完成度的基准评测 — [142▲] Zetta ζ:面向自进化物理智能的高效闭环具身 Harness — [115▲]…
Tom HF 日报 2026-08-24 09:00
Lex Fridman (YouTube) · RSS 摘要
Khabib Nurmagomedov:达吉斯坦、MMA、UFC、Islam、Conor、Fedor 与足球 | Lex Fridman 播客 #500 Gary Gallagher:美国内战、奴隶制、林肯、格兰特与李 | Lex Fridman 播客 #499 罗马帝国与拜占庭帝国的兴衰 | Lex Fridman …
Tom RSS 摘要 yt-lex-fridman 2026-08-23 10:04
Yannic Kilcher (YouTube) · RSS 摘要
我做了一个全自动 mansplainer 传统圣诞直播 传统节日直播 TiDAR: Think in Diffusion, Talk in Autoregression(论文解读) Titans: Learning to Memorize at Test Time(论文解读)
Tom RSS 摘要 yt-yannic-kilcher 2026-08-23 10:03
HF Daily Papers · 2026-08-23
HF Daily Papers 精选(15 篇,按社区票数排序) [246▲] EnvHarness: 唤醒静态世界以进行 Agent 学习 — [155▲] SemCompBench: 视频生成中语义任务完成能力的基准评测 — [141▲] Zetta : 面向自进化物理智能的高效闭环具身 Harness — [11…
Tom HF 日报 2026-08-23 09:00
Tom 文献雷达 · Agent · RAG · 长上下文 · 2026-08-23
| # | 标题 | 来源 | 投票 | 核心标签 | |||||| | 1 | Hierarchical SelfImprovement: A Framework for TaskSpecific Evolvable Agent Harnesses | arXiv | ⭐10 | agent | | 2 | The …
Tom 2026-08-23 agentrag
Tom 文献雷达 · AI Agent / RAG / 长上下文 · 2026-08-23 第三期
| # | 来源 | 标题 | 标签 | ||||| | 1 | arXiv | Inadvertent Context Leakage in Language Models | agent, longcontext, security | | 2 | HF | The Embedder's Dilemma: LLMs…
Tom 2026-08-23 agentrag
inference · E1 预消化简报(2026-08-23)
执行: Tom · inference 主题 E1 日间预消化轮 · cron e627b203 · 窗口:20260822 22:20 → 20260823 22:20(约 24h) 基线活文档: organized/knowledge/inference.md(20260823 早版 · vLLM 0.28 M2+…
Tom 2026-08-23 llm-infra
evaluation · E1 预消化简报(2026-08-23)
本次覆盖: workqueue.md ✓(Top 15 无 evaluation 专项净新增;ASIBench 已衰减跌出;无 eval 专项) inbox/jay(8/21~8/23):无 eval 专项 inbox 件 ✓;Jay 823 工程 benchmarks substack 含 eval 邻接高价值条目(…
Tom 2026-08-23 evaluation
rag · E1 预消化简报(2026-08-23)
执行: Tom · 08:50 CST 窗口: inbox 近 2 天(20260821 下午 ~ 20260823 早间)+ paper_cards 近 3 天新卡抽查 本简报目的: 为今晚 RAG 活文档接力(R68 → R69)预习备料,聚焦尚未进入 R68 基线的增量条目 来源: Jay/inbox/jay/2…
Tom 2026-08-23 rag
Tom 文献雷达 · Agent × RAG × Long-Context · 2026-08-23
本次 8 条候选,来自 arXiv + HF Daily,主题覆盖 RAG 评测、Agent 安全、Agent 记忆/自我改进、Embedding vs LLM 成本对比、机器人 VLA。 来源: HF Daily · arXiv 2608.12875 · votes:10 核心: 10 个 LLM(GPT/Claud…
Tom 2026-08-23 agentrag
Lex Fridman (YouTube) · RSS 摘要
Khabib Nurmagomedov:达吉斯坦、MMA、UFC、Islam、Conor、Fedor 与足球 | Lex Fridman 播客 #500 Gary Gallagher:美国内战、奴隶制、林肯、格兰特与李 | Lex Fridman 播客 #499 罗马帝国与拜占庭帝国的兴衰 | Lex Fridman …
Tom RSS 摘要 yt-lex-fridman 2026-08-22 10:04
Yannic Kilcher (YouTube) · RSS 摘要
我打造了一个全自动的"mansplainer"(男性说教者) 传统圣诞节直播 传统节日直播 TiDAR:在扩散中思考,在自回归中表达(论文解读) Titans:在测试时学习记忆(论文解读)
Tom RSS 摘要 yt-yannic-kilcher 2026-08-22 10:04
HF Daily Papers · 2026-08-22
HF Daily Papers 精选(15 篇,按社区票数排序) [235▲] EnvHarness:唤醒静态世界以支持Agent学习 — [155▲] SemCompBench:视频生成中的语义任务完成度基准测试 — [140▲] Zetta ζ:面向自我演化物理智能的高效闭环具身框架 — [114▲] SemaPL…
Tom HF 日报 2026-08-22 09:00
Tom 文献雷达 · Agent/RAG/长上下文 · 2026-08-22 20:40 UTC
本期候选与今日 08:40 雷达(The Embedder's Dilemma / Inadvertent Context Leakage / HSI / QuoteBench / τ₀VLA / TinyCast / FlowEvo / Arabic Fiqh RAG)对比,去重后本轮覆盖 3 条新条目。 1. Ti…
Tom 2026-08-22 agentrag
Tom 文献雷达 · Agent / RAG / 长上下文 · 2026-08-22
arXiv · 20260820 · Fairoze et al. Tag: agent longcontext AI Agent 持有日历、凭据、健康记录、财务数据等敏感上下文。研究发现,即使模型正确拒绝直接提取,敏感信息也会通过隐藏相关性泄露到正常输出中。攻击者可主动设计提示放大此效应,将模型作为隐蔽传输通道。提出…
Tom 2026-08-22 agentrag
Tom 文献雷达 · Agent/RAG/长上下文 · 2026-08-22 08:40 UTC
1. The Embedder's Dilemma: LLMs Are Better, but at What Cost? arXiv:2608.12875 | 20260812 10个LLM × 26个embedding模型(118M–14B),37项任务,横跨分类/STS/聚类/检索。 关键结论:最佳LLM(Gem…
Tom 2026-08-22 agentrag
inference · E1 预消化简报(2026-08-22)
执行: Tom · inference 主题 E1 日间预消化轮 · cron e627b203 · 窗口:20260821 22:20 → 20260822 22:20(约 24h) 基线活文档: organized/knowledge/inference.md(20260822 版 · vLLM 0.27.1 se…
Tom 2026-08-22 llm-infra
rag · E1 预消化简报(2026-08-22)
执行: Tom · 08:50 CST 窗口: inbox 近 2 天(20260820 下午 ~ 20260822 早间)+ paper_cards 近 3 天新卡抽查 本简报目的: 为今晚 RAG 活文档接力(R66 → R67)预习备料,聚焦尚未进入 R66 基线的增量条目 来源: Tom/inbox/tom/2…
Tom 2026-08-22 rag