Stephen · 每日协调检查 · 傍晚档(2026-08-01 22:45 CST)

本实例:Stephen(总协调) 本稿目的:在 12:45 CST noon 协调棒(基线)基础上,把 8-1 下午到晚间各实例新增产出做一次 evening 跨实例覆盖度复盘与冲突核对,重点是 ① 12:45 → 22:45 之间出现的 5 实例新草稿(特别是 jay 6 篇 evening briefing 1300/1505/1620/1735/1950/2105、tom inference-e1prep、flyp risk-e1prep、stephen llm-application-e1prep、spark agent/llm-infra)的整合消化;② 跨实例新立标的同步状态;③ 跨活文档(ai-industry / rag / multimodal / engineering / llm-application / inference / llm-infra / risk / agent)编排窗口的统一建议;④ 7-31 noon/evening 协调棒续立信号的回访。 本稿 GitHub 写入:0(按规则不执行 git commit / git push / gh pr) 建议落点/shared/research-kb/inbox/stephen/2026-08-01-2245-stephen-coordination-check-evening.md(最终整合任务再写 review/,本稿先在 inbox 立标)


一、本次主题

跨实例协调复盘(agent / rag / multimodal / engineering / systems / csdn / substack / risk / llm-application / llm-infra 十向覆盖度 + 冲突核对 + 缺口标注 + 编排窗口建议 + 人工确认)


二、检索范围

  • 今天 inbox 各实例 evening 产出(stephen / tom / jay / flyp / spark 共 ~35 篇新草稿)
  • 12:45 → 22:45 CST 之间晚间高频推送与 evening briefing
  • 7-31 evening 协调棒 + 8-1 noon 协调棒(基线参考)
  • HF Daily / arXiv / Substack / CSDN / MSR Blog / Sigcomm / Import AI / EuroSys / ICDCS / ICLR / NDSS 公开来源(在前置各实例简报已核过的前提下,不重复检索)

三、十向覆盖度盘点(evening 完整态)

✅ A. Agent(含多智能体、agent memory、agent harness)

  • Stephen:llm-application-e1prep(5 重大 + 3 旁证 = 8 件;OpenAI ChatGPT Agent 三层架构 + MSR Echoverse + MirrorCode + FutureAGI 五指标 + Fairness Pruning + BM25/OP-RAG + SymCrypt 形式化验证 + MCP 2.0 stateless + Σ-Mem 第五路 + Lilian Weng 八元组 + Mythos 密码学)
  • Tom:agent-rag-longcontext-radar v2/v3(8 候选 4 高价值:Σ-Mem + Filesystem + DualG-MRAG + GLM-RAG)+ inference-e1prep(旁证 MCP 2.0 + Lilian Weng Harness + ByteByteGo Agent Loop = Agentic 推理三层架构收敛)
  • Jay:6 篇 evening briefing 串联产出(八元组公式 + ByteByteGo 三层架构 + MirrorCode benchmark + SymCrypt Rust 形式化验证 + MSR Echoverse 合成世界 + 6 维度工具集 = 全员汇聚到 Agentic Engineering §2.7 学科化 + 工程复现 §2.14)
  • Flyp:risk-e1prep(R34 立标固化期延续 + Σ-Mem arXiv:2607.27958 trust-modeling-as-attack-surface 三联立 + Filesystem arXiv:2607.26637 filesystem-as-attack-surface 四联立 + MisKnow-Agent deep-research-as-attack-surface 三联立 + 1 项 NDSS P0 警示 Shadow in the Cache arXiv:2508.09442)+ ShadowDancer/CoMem critical-read
  • Spark:agent-e1prep-v37(24h 净增量 6 件 P0/P1 立标候选 + 2 件 P1/P2 邻接 + 1 件警示 EU AI Act 8-2 deadline 临门 + 1 件反方 + 1 件状态变化)
  • 冲突:无重复(5 实例同步立标饱和:Σ-Mem / Filesystem-Based Memory / DualG-MRAG / GLM-RAG / MisKnow-Agent / ConMem 在 5 实例的 8 草稿中已全覆盖;stephen + jay + tom + flyp + spark 互为对照,未出现新增 arXiv 编号
  • 饱和度:极高

✅ B. RAG

  • Stephen:ai-industry-e1prep(BM25 Wins at Scale 38▲ + HF Daily 8-1 票榜 + 主线 7 VLA 飞轮邻居 PhiZero)+ llm-application-e1prep(FutureAGI RAG Reimagined + FutureAGI 五指标)
  • Tom:rag-e1prep(R50 收官延续 + R51 启动准备就位)+ 雷达 v2(8 候选 4 高价值)+ evaluation-e1prep(3 增量)
  • Jay:1105 briefing(pgvectorscale 471 QPS @ 99% recall 11.4× Qdrant + PostgreSQL CIDR 2026 + LanceDB + 混合检索)+ 1220 csdn-rag-agent-moe(RAG 2026 实战 4 件 = GraphRAG + AgenticRAG + VisionRAG + 五步优化 + 5 大 Agent 框架横评)+ 1505 briefing(KV Cache Transform Coding ICLR 2026 邻接)+ 1950 briefing(KV Cache Transform Coding + Particula-SGLang 29% + RAG 评估工具格局)+ 2105 briefing(RAG 2026 架构格局 Future AGI / Turing Post 20 种 + 六层 pipeline 评估 + 混合检索 + Reranker 当下最优基线)
  • Flyp:deep-read + adversarial-review(BM25 / DualG-MRAG / Filesystem 三联立 + 反方元层 6 条证伪线/件 + 哲学综述沿用)
  • Spark:未单独做 RAG 一线(让位 tom/jay/flyp)
  • 冲突
  • flyp vs tom 对 DualG-MRAG / Filesystem 的视角差:tom 立标(rag 主 multimodal 副),flyp 反方审稿(在"工程经验 vs 学术评测"微妙偏差上)。两者并非冲突,是同件套的双视角。
  • FutureAGI RAG Reimagined(stephen llm-application-e1prep 增量 6)vs FutureAGI / Turing Post 20 Advanced RAG Types(jay 2105 briefing C2)两个独立来源(Substack + 综述) 都用 FutureAGI 名义,但 jay 写"Future AGI / Turing Post"为二源,stephen 写"FutureAGI Substack"为单源——同一公司不同发布渠道,无内容冲突,建议在活文档 v42/v43 同步引用。
  • 饱和度:高(事件饱和 + 4 实例重叠,应避免新立 RAG 主线;下周再启动增量)

✅ C. Multimodal(vision-language-video)

  • Stephen:ai-industry-e1prep(Cosmos-H-Dreams + PhiZero + Gemini Robotics 2 邻接)+ X radar 0910(Mythos HAWK/AES 7-28 + HF 加入 Open Secure AI Alliance 7-27 + Anthropic 3 起事件 7-27 + HF Training Agents 3 7-28 + AMI Labs $1.03B 7 月 + Sam Altman 白宫自愿评估框架 7-29)
  • Tom:radar See2Think 邻接 + HF Daily Qwen-UI-Agent 265▲ 票榜立标(GUI 基础 Agent,多模态邻接)
  • Jay:engineering-e1prep(MirrorCode 25 目标程序 + Lilian Weng 八元组 + ByteByteGo 三层架构 + MSR SymCrypt + Echoverse)+ 1300 briefing(GoodServe/AMPD/LAAR/AIConfigurator/Workload-Router-Pool/Fluid-Guided 6 件 inference 新论文)
  • Flyp:multimodal-e1prep-v35 第一棒(14 件候选增量 = See2Think + ShadowDancer + LEDGERMIND + CoMem + DualG-MRAG + Kimi K3 + X radar 9 件)+ risk-e1prep(Shadow in the Cache arXiv:2508.09442 NDSS 2026 KV-cache 隐私/侧信道 = multimodal 邻接安全)
  • Spark:未单独做 multimodal 一线(让位 flyp)
  • 冲突点
  • multimodal 活文档 v34 已 96h 未更新,超 3 天红线 24h(flyp multimodal-e1prep v35 第一棒明示)—— 本场 evening 必须启动 v34 → v35 编排窗口(紧迫度:高)
  • stephen 8-1 X radar 0910 + flyp multimodal-e1prep 7 件包络确认:双方一致(4 件立标候选 = Mythos Preview + Anthropic 3 起事件 + Sam Altman 白宫自愿评估框架 + HF Training Agents 3),无需协调
  • 饱和度:高

✅ D. Systems / Engineering(推理系统 / 工程实践 / 系统化)

  • Stephen:ai-industry(HF blog LFM2.5-Encoders CPU 长文本编码器 3.7× ModernBERT + LlamaParse 智能路由)+ llm-application-e1prep(OpenAI ChatGPT Agent 三层架构生产实例 + MSR Echoverse 训练时合成世界 + MirrorCode 超长程评测 + FutureAGI 五指标 + SymCrypt 形式化验证 + MCP 2.0 stateless)
  • Tom:inference-e1prep(6 主线 + 2 旁证:GoodServe E2E-SLO goodput + AMPD Multi-round PD 分 离 + LAAR NUMA-aware long-context routing + Token-Operations 四层架构 + Harvest P2P GPU cache 43.48% 利用率 + Agent Memory Edge Q4 KV cache + 旁证 MCP 2.0 + Lilian Weng + ByteByteGo Agent Loop + SuperInfer GH200 + KernelSight-LM)
  • Jay:engineering-e1prep-v42 6 增量(ByteByteGo 三层架构 + MirrorCode + Lilian Weng 八元组 + Simon Willison MCP 2.0 + MSR Echoverse + MSR SymCrypt)+ 1105 briefing(5 数据库/后端/云原生复现档)+ 1300 briefing(6 件 inference-systems arXiv 新论文)+ 1505 briefing(MCP 2.0 + KV Cache Transform Coding + DUAL-BLADE + Shadow in the Cache + MirrorCode)+ 1620 csdn-rag-agent-tensorrt-deploy(NVIDIA TensorRT-LLM Qwen3 命令 + PyTorch-CUDA-v2.7 + DeepSeek-R1 + PyTorch Quantization)+ 1735 briefing(vLLM/SGLang/TGI/TRT-LLM H100 benchmark + 2026 模型格局 + HF State of OS Spring 2026 + AI Engineer 1000+ JD + GitHub Top 12)+ 1950 briefing(KV Cache Transform Coding ICLR 2026 + Harvest P2P + Agent Memory Edge Q4 + Particula-SGLang 29%)+ 2105 briefing(Bespoke OLAP ICLR 2026 + GenDB + HotPrefix SIGMOD 2026 + pgvector 0.9 VecDB 2026 + llm-d CNCF Sandbox + Kthena + CXL Memory-Disaggregated HotInfra 2026 + LLM 推理指纹 CVE-2026 + vLLM vs SGLang H100 基准 + Weaviate v1.37 MCP Server)
  • Flyp:deep-read + adversarial-review(BM25 / DualG-MRAG / Filesystem 三件的工程经验 vs 学术评测对照 = 6 条证伪线/件)
  • Spark:llm-infra-e1prep(5 主线 + 3 旁证 + 2 警示:KV Cache 顶会三件套 ICDCS/ICLR/NDSS + Agentic Serving 三件套 GoodServe/AMPD/Workload-Router-Pool + AIConfigurator + Fluid-Guided + 推理引擎 4 选 1 + MCP 2.0 + MSR Echoverse + MSR SymCrypt)
  • 冲突点
  • tom inference-e1prep + spark llm-infra-e1prep + jay 1300/1950 briefing 三实例对 GoodServe/AMPD/LAAR/Token-Operations/Harvest/Agent Memory/Workload-Router-Pool/AIConfigurator/Fluid-Guided 的视角差
    • tom:以"调度 §2.2 / KV cache §2.3"分类立标(inference.md 主线锚点)
    • spark:以"KV cache 顶会三件套 + Agentic Serving 立标三件套"分类立标(llm-infra.md §1.(3) + §1.(2) 调度 9 学派邻接)
    • jay:以"早间 + 午间 + 傍晚 6 高价值论文"分类立标(engineering.md §2.95 evaluation discipline + §2.7 Agentic Engineering 学科化邻接)
    • 三视角互补不冲突:建议在 inference.md / llm-infra.md / engineering.md 三份活文档同步立标,引用同一 arXiv 编号但视角不同
  • jay 1105 briefing pgvectorscale 471 QPS @ 99% recall 11.4× Qdrant 数据(Actian Q2 2026 + Firecrawl)与现有 VecDB 选型共识:写入路径正确,但提示读者 pgvectorscale 在 r6id.4xlarge AWS 实例 + Cohere Wikipedia 768 维 50M 上才达到此数字,工程落地时不能直接外推到生产(已在 noon 协调棒标注)
  • jay 2105 briefing Bespoke OLAP ICLR 2026 + CXL Memory-Disaggregated HotInfra 2026 + Weaviate v1.37 MCP Server:3 件大信号——Bespoke OLAP 51× speedup + CXL PIM-DIMM 39.7× cost reduction + Weaviate 原生 MCP Server = 数据库 + 系统 + 向量 DB 三大基础设施跃迁
  • 饱和度:极高

✅ E. CSDN(工程实践层 · 严格筛选)

  • Jay:今天 8 篇 CSDN 主题稿
  • 0821 csdn-substack-weekly(火山引擎 · vLLM 投机解码 · SGLang · 2026 AI 技术路线图)
  • 1050 jay-engineering-filter(10 条高价值 = Kimi K3 权重开源 / DeepSeek-V4-Flash / Solar / OpenAI HF 评估安全事件 / Kimi K3 inference 子节 / 边缘部署 8 项)
  • 1058 engineering-e1prep-v42 准备棒
  • 1220 csdn-rag-agent-moe(RAG 实战 4 篇 + Agent 框架 4 篇 + MoE 3 篇 + LangChain 1 篇 = 12 件)
  • 1620 csdn-rag-agent-tensorrt-deploy(NVIDIA TensorRT-LLM Qwen3 部署 + PyTorch-CUDA-v2.7 + DeepSeek-R1 + YOLOv8 DFL + PyTorch Quantization)
  • 1240 隐线(增量补充件)
  • 1335 jay-arxiv-inference-systems-vecdb-2026(SGLang vs vLLM + Workload-Router-Pool + Fluid-Guided)
  • 1735 jay-inference-engines-open-llms-2026(YottaLabs + Spheron + DeployBase 推理引擎横评)
  • 其他实例:未单独做 CSDN 一线(让位 jay)
  • 饱和度:极高

✅ F. Substack / RSS(高质量评论、行业 newsletter)

  • Stephen:X 名人雷达 0910(Sam Altman / Anthropic / DeepMind / HF / Jim Fan / Mollick / Karpathy / Andrew Ng / Yann LeCun 13 件)
  • Tom:103 RSS 频道(Lex Fridman + Yannic Kilcher)+ HF Daily 8-1 票榜
  • Jay:11 RSS 频道(bytebytego / simon-willison / raschka / nathan-benaich / lilian-weng / cool-papers(-ir/-regular) / msr-blog / import-ai / yt-karpathy / yt-fireship)+ csdn-substack-weekly 0821(含海外 Substack 旁路)
  • Flyp:interconnects / cameron-wolfe + deep-read 中 jamwithai 1 条 + rasbt "LLM Research Papers 2026" 1 条 = 3 条 Substack 线索
  • Spark:chip-huyen / gradient-flow = 2 条线索(含"AI 可以胜出而数据中心却亏损"批评线索)
  • 冲突点
  • flyp rasbt "LLM Research Papers: The 2026 List (January to May)" 7-30 综述与 stephen ai-industry 主线 (174) AI 综述邻接:两者无引用重复,建议在活文档 v34 §6 行业 13 主线里只选一条为主线立标,另一条作"延伸追踪"
  • stephen llm-application-e1prep 增量 6 FutureAGI Substack "RAG Reimagined 5 Breakthroughs" 与 jay 2105 briefing C2 Future AGI / Turing Post "20 Advanced RAG Types":同源不同发布渠道,无内容冲突
  • Substack 缺口(按 6-10 启用规则):
  • r.jina.ai / jlelse substack / Latent Space(swyx)/ The Pragmatic Engineer / benn.substack / Last Week in AI:今天 5 个实例未单独做这一线索汇总 → noon 协调棒已标注"下周一并入"
  • jay 2105 briefing C1 The AI Engineer Substack "AI Agents Stack 2026 Edition"(swyx + Alessi) = 本场 evening 新补充 1 条高质量 Substack 线索(八十千订阅),归入本期 Substack 覆盖
  • 饱和度:中高(缺口见上 + evening 已补 swyx 1 条)

✅ G. 工程复现 / 排障(高价值 CSDN 子集)

  • Jay:1105 briefing(5 条复现档 · pgvector + PostgreSQL + LanceDB + Kimi K3 + DeepSeek-V4 工程化)+ 0821 csdn-substack-weekly(vLLM 投机解码源码解析 · LangChain OpenDeepResearch 本地部署)+ 1620 csdn-rag-agent-tensorrt-deploy(NVIDIA TensorRT-LLM 完整命令栈)+ 2105 briefing R1 Bespoke OLAP 开源实现可直接复现
  • 其他实例:未单独做
  • 饱和度:高(事件饱和)

✅ H. Risk / Security(新增 evening 向)

  • Flyp:risk-e1prep R34 立标固化延续(7 条 net-new 增量 = 1 项 NDSS P0 警示 Shadow in the Cache + 2 P1 Σ-Mem + Filesystem trust-modeling-as-attack-surface 三联立 + filesystem-as-attack-surface 四联立 + 1 P1 MisKnow-Agent deep-research-as-attack-surface 三联立 + 1 P0 EU AI Act 8-2 24h 临门 + 2 P2/P3 OpenAI/HF + 1 强提醒 Sam Altman + 1 元方法学 MSR SymCrypt = 38 件 arXiv + 8 条待核实说法 + R34 已固化立标的持续续立信号表)
  • Stephen:ai-industry-e1prep 增量 2(EU AI Act 8-2 deadline 临门)+ 增量 5(Sam Altman 华盛顿政策窗口 + 白宫自愿评估框架)+ 增量 7(OpenAI HF 模型评估安全事件 + 8-1 捣毁柬埔寨诈骗犯罪团伙 = frontier lab × 安全工程 第 7/8 例)+ 增量 8(HF 加入 Open Secure AI Alliance = 第 4 立家)
  • Jay:1505 briefing D3 Shadow in the Cache NDSS 2026 KV-cache 隐私/侧信道;1735 briefing D2 AI Engineer 1000+ JD 含 frontier lab × 安全工程邻接
  • Spark:agent-e1prep-v37 增量 5 MisKnow-Agent deep-research-as-attack-surface 三联立 + §增量 7 OpenAI 捣毁诈骗犯罪 + Open Secure AI Alliance
  • 冲突
  • flyp risk-e1prep 与 stephen ai-industry-e1prep 对 EU AI Act 8-2 临门态势:stephen 视角为 8-1 上午(增量 2 §),flyp 视角为 8-1 下午(增量 5 §);差 ~6h,建议沿用 stephen 时间口径("deadline 倒计时 36h → 0h · 8-1 上午"),footnote 给 flyp 8-1 下午时间口径
  • flyp risk-e1prep 与 jay 1505 briefing D3 对 Shadow in the Cache 立标位:flyp 立"§2.1 ⑥ L0' 元层+dev 风险类目 第 2 例 + KV-cache 侧信道";jay 标注"Engineering 复现必备"。两者互补不冲突
  • flyp risk-e1prep 与 spark agent-e1prep-v37 对 Σ-Mem trust-modeling-as-attack-surface 三联立:flyp 立"R34 §2.1 C 类立标候选 第 3 拍 + 信任建模侧分支";spark 立"Σ-Mem vs Metis 内化原生 vs 外化可信两条腿"。两者互补
  • 饱和度:高

✅ I. LLM Application / Harness Engineering(新增 evening 向)

  • Stephen:llm-application-e1prep(5 重大 + 3 旁证 = 8 件净增量 + 15 件已立 v42 激活 + 13 件非论文来源 = 36 件涉及项;OpenAI ChatGPT Agent 三层架构 + MSR Echoverse + MirrorCode + FutureAGI 五指标 + Fairness Pruning + BM25/OP-RAG + SymCrypt 形式化验证 + MCP 2.0 stateless + Σ-Mem 第五路 Memory + Lilian Weng 八元组 + Mythos 密码学)
  • Tom:inference-e1prep 旁证 1(MCP 2.0 + Lilian Weng Harness + ByteByteGo OpenAI Agent Loop = Agentic 推理三层架构收敛)
  • Jay:engineering-e1prep 增量 1-6(ByteByteGo 三层架构 + MirrorCode + Lilian Weng 八元组 + Simon Willison MCP 2.0 + MSR Echoverse + MSR SymCrypt)
  • Flyp:未单独做 LLM Application 一线(让位 stephen)
  • Spark:未单独做 LLM Application 一线(让位 stephen)
  • 冲突
  • stephen llm-application-e1prep + jay engineering-e1prep 6 增量完全重合:stephen 主线锚点(llm-application.md v42 → v43)+ jay 工程化(engineering.md v41 → v42)双活文档同步升级
  • Lilian Weng 八元组公式 vs ByteByteGo 三层架构:stephen 整合两者为"v43 §1.1 整合时需说'两层抽象同时存在'";jay 未明确整合两者,建议在 engineering.md v42 §2.7 也添加 footnote
  • 饱和度:极高(事件饱和)

✅ J. LLM Infra / Inference Systems(新增 evening 向)

  • Tom:inference-e1prep(6 主线 + 2 旁证 + 1 警示 = 8 件净增量 + 38 件 arXiv 编号)
  • Spark:llm-infra-e1prep(5 主线 + 3 旁证 + 2 警示 = 7 主线 + 3 旁证 + 2 警示;KV Cache 顶会三件套 + Agentic Serving 三件套 + AIConfigurator + Fluid-Guided + 推理引擎 4 选 1 + MCP 2.0 + MSR Echoverse + MSR SymCrypt)
  • Jay:1300 briefing 6 件 inference 新论文 + 1735 briefing 4 件推理引擎横评 + 1950 briefing KV cache + 2105 briefing llm-d CNCF + Kthena + CXL Memory-Disaggregated + HotPrefix SIGMOD 2026 + vLLM/SGLang CVE-2026
  • Stephen:未单独做 llm-infra 一线(让位 tom/spark)
  • Flyp:未单独做 llm-infra 一线(让位 tom/spark)
  • 冲突
  • tom inference-e1prep + spark llm-infra-e1prep 对 GoodServe/AMPD/LAAR/Harvest/Agent Memory/Token-Operations 立标位的视角差:tom 立 inference.md,spark 立 llm-infra.md,两份活文档同步升级,引用同一 arXiv 编号
  • tom inference-e1prep 与 stephen llm-application-e1prep 对 Agentic 推理三层架构收敛(MCP 2.0 + Lilian Weng + ByteByteGo):tom 在 §7 Agent 生产推理邻接;stephen 在 §1.1 应用架构 + §5 工程落地框架 #3 状态分层。两者互补,建议双活文档同步升级
  • spark llm-infra-e1prep 警示 "tom 7-31 inference E1 已恢复但 8-1 仅 6 件常规通稿 0 件 inference-e1prep · spark 8-1 morning 第 8 棒独立 E1 仍缺"傍晚已修正——tom 8-1 22:24 inference-e1prep 已写入;spark llm-infra-e1prep-v13 已写入。无冲突
  • 饱和度:极高

四、跨实例冲突 / 重复 / 缺口 三向核对(evening 完整态)

1. 重大重复(需要合并或分流)

触及实例 重复性质 建议处置
Σ-Mem (arXiv:2607.27958) stephen(ai-industry+llm-application) + tom(radar+RAG e1prep) + jay(no) + flyp(deep-read+adversarial+critical-read+risk-e1prep) + spark(agent-e1prep) + paper_cards/683 6 实例 6 文件同源立标饱和 flyp risk-e1prep 立"R34 §2.1 C 类立标候选 第 3 拍 + trust-modeling-as-attack-surface 三联立首例";stephen llm-application 立"§1.3 Memory 第五路候选";tom radar + rag-e1prep 立"R51 §2.17 K 候选";spark agent-e1prep 立"v37 §2.2 第六十二节点";统一编号 Σ-Mem = arXiv:2607.27958,各活文档独立引用,不重写
Filesystem-Based Memory (arXiv:2607.26637) stephen(ai-industry+noon+llm-application 旁证 B 邻接) + tom(radar+RAG e1prep) + jay(no+ lilian-weng RSS Pattern 2) + flyp(deep-read+adversarial 论文 C+critical-read+multimodal-e1prep+risk-e1prep) + spark(agent-e1prep) + paper_cards/686 6 实例 6 文件同源立标饱和 flyp risk-e1prep 立"filesystem-as-attack-surface 四联立";stephen noon 立"§2.17 J 候选";tom radar + rag-e1prep 立"R51 §2.17 J";spark agent-e1prep 立"v37 §2.2 候选新增 L 雏形";统一编号,各活文档独立引用
DualG-MRAG (arXiv:2607.28580) stephen(ai-industry 邻接) + tom(radar+RAG e1prep) + jay(c1260/last) + flyp(deep-read+adversarial+multimodal-e1prep) + spark(agent-e1prep) + paper_cards/674 5 实例同源 + 1 隐含 立标统一归 tom R51 §2 主线 + flyp 反方 + multimodal §1.3 综述邻接 + spark agent §2.2 候选 + stephen ai-industry 邻接 + jay csdn 邻接
GLM-RAG (arXiv:2607.28397) stephen(no) + tom(radar+RAG e1prep) + jay(c1220) + flyp(no) + spark(agent-e1prep) + paper_cards/675 4 实例同源 沿用 rag.md R51 §2 候选
MisKnow-Agent (arXiv:2607.20891) stephen(noon) + tom(radar v2) + jay(c1220) + flyp(risk-e1prep 增量 4) + spark(agent-e1prep 增量 5) + paper_cards/687 5 实例同源 flyp risk-e1prep 立"deep-research-as-attack-surface 三联立 L2 接口层 第 1 例"
ConMem (arXiv:2607.28126) stephen(ai-industry 邻接) + tom(radar+RAG e1prep) + jay(no) + flyp(no) + spark(agent-e1prep) + paper_cards/676 4 实例同源 rag.md R51 §2.17 候选 L + agent.md §2.2 邻接 + risk.md §2.1 C 类立标候选 P2 沿用
CoMem (arXiv:2607.28263) stephen(llm-application 邻接) + tom(no) + jay(no) + flyp(multimodal-e1prep 增量 4+critical-read) + spark(agent-e1prep 邻接) + paper_cards/678 4 实例同源 multimodal.md v35 §1.2 长上下文 / 长记忆邻接 + agent.md §2.2 邻接
ShadowDancer (arXiv:2607.28362) stephen(no) + tom(no) + jay(no) + flyp(multimodal-e1prep 增量 2+critical-read 1550) + spark(no) + paper_cards/682 2 实例同源 + 2 paper_cards multimodal.md v35 §2.39.x 候补级
LEDGERMIND (arXiv:2607.28374) stephen(llm-application 邻接) + tom(no) + jay(no) + flyp(multimodal-e1prep 增量 3) + spark(no) + paper_cards/680 2 实例同源 multimodal.md v35 §2.39.x 候补级 + llm-application.md §1.4 评测与可靠性邻接
See2Think (arXiv:2607.26769) stephen(llm-application 旁证) + tom(radar) + jay(no) + flyp(multimodal-e1prep 增量 1+critical-read 1550) + spark(no) + paper_cards/685 3 实例同源 multimodal.md v35 §1 主线 4 评测方法学新增 + llm-application.md §1.4 评测与可靠性 + rag.md 评测方法邻接
Fairness Pruning (arXiv:2607.28319) stephen(llm-application 增量 5) + tom(evaluation-e1prep 增量 1+ radar) + jay(no) + flyp(risk-e1prep 邻接) + spark(agent-e1prep) + paper_cards/684 4 实例同源 evaluation.md R33 §1.4 评测与可靠性 + llm-application.md §1.4 + risk.md §2.6 沿用
Kimi K3 2.8T (BenchLM #2/32 89.6/100) stephen(ai-industry) + jay(engineering-filter+0935) + flyp(multimodal-e1prep 增量 6) 3 实例覆盖但视角不同 multimodal.md v35 §6 行业 8 主线 + engineering.md v42 §6 行业延伸 + ai-industry.md v34 §6 行业 17 足候选
MirrorCode benchmark (METR/Epoch AI 8-1) stephen(llm-application 增量 3) + jay(engineering-e1prep 增量 2+1505 briefing R1) + flyp(no) + spark(no) 3 实例覆盖 engineering.md v42 §2.8 + llm-application.md v43 §1.1 Coding Agent 评测
MSR Echoverse (训练 Computer-Use Agent 合成世界) stephen(llm-application 增量 2) + jay(engineering-e1prep 增量 5) + spark(llm-infra-e1prep) 3 实例覆盖 llm-application.md v43 §1.1 + engineering.md v42 §2.14
MSR SymCrypt Rust+Lean+Aeneas 形式化验证 stephen(llm-application 增量 7) + jay(engineering-e1prep 增量 6) + spark(llm-infra-e1prep 邻接) + flyp(risk-e1prep 增量 7) 4 实例覆盖 llm-application.md v43 §1.4 + engineering.md v42 §2.15 + risk.md §2.6 frontier lab × 安全工程 第 6 例 + llm-infra.md §1.(10) 沿用
Lilian Weng Harness Engineering 八元组公式 stephen(llm-application 旁证 B) + jay(engineering-e1prep 增量 3) + tom(inference-e1prep 旁证 1) 3 实例覆盖 llm-application.md v43 §1.1 + engineering.md v42 §2.7 + inference.md §7
ByteByteGo OpenAI ChatGPT Agent 三层架构 stephen(llm-application 增量 1) + jay(engineering-e1prep 增量 1) + tom(inference-e1prep 旁证 1) 3 实例覆盖 llm-application.md v43 §1.1 + engineering.md v42 §2.7 + inference.md §7
MCP 2.0 stateless 协议(Simon Willison + 官方 7-28) stephen(llm-application 增量 8) + jay(engineering-e1prep 增量 4) + tom(inference-e1prep 旁证 1) + spark(llm-infra-e1prep 旁证) 4 实例覆盖 llm-application.md v43 §1.1 + engineering.md v42 §2.7 + inference.md §7 + llm-infra.md §1.(4)
FutureAGI RAG 五指标 + RAG Reimagined stephen(llm-application 增量 4+6) + jay(2105 briefing C2) + tom(evaluation-e1prep 增量 3) 3 实例覆盖 llm-application.md v43 §1.2 + rag.md R51 §2 + evaluation.md R33 §1.4
OpenAI 8-1「推进欧洲负责任 AI」 + EU AI Act 8-2 临门 stephen(ai-industry 增量 2) + flyp(risk-e1prep 增量 5) + spark(agent-e1prep 警示) 3 实例覆盖 ai-industry.md v34 §1.3 frontier lab × 治理 + risk.md §2.1 ⑧ 24h 临门 + agent.md §3.2 警示沿用
Shadow in the Cache NDSS 2026 (arXiv:2508.09442) flyp(risk-e1prep 增量 1) + spark(llm-infra-e1prep 增量 1 D3) + jay(1505 briefing D3) + tom(inference-e1prep 横向参照) 4 实例覆盖 risk.md §2.1 L0' 元层+dev 风险类目 第 2 例 + llm-infra.md §1.(3) KV cache 14+1 件套新增 DUAL-BLADE/Transform Coding/Shadow in the Cache 作为「七大顶会议 KV-cache 集中爆发立标」+ inference.md §2.3 横向参照
KV Cache 顶会三件套 (DUAL-BLADE ICDCS 2026 + KV Cache Transform Coding ICLR 2026 + Shadow in the Cache NDSS 2026) spark(llm-infra-e1prep 增量 1) + jay(1505 briefing D1/D2/D3+1950 briefing E1) + tom(inference-e1prep 横向参照) + flyp(risk-e1prep 增量 1) 4 实例覆盖 llm-infra.md §1.(3) 七大顶会议 KV-cache 集中爆发立标 + risk.md §2.1 邻接 + inference.md §2.3 邻接
Agentic Serving 调度立标三件套 (GoodServe + AMPD + Workload-Router-Pool) tom(inference-e1prep 增量 1+2) + spark(llm-infra-e1prep 增量 2) + jay(1300 briefing A1/A2/A5) 3 实例覆盖 inference.md §2.2 调度 + llm-infra.md §1.(2) 调度 9 学派邻接 + engineering.md §2.95 evaluation discipline 邻接
OpenAI 8-1 捣毁柬埔寨诈骗犯罪团伙 + HF 加入 Open Secure AI Alliance stephen(ai-industry 增量 7+8) + flyp(risk-e1prep 增量 6) + spark(agent-e1prep 增量 7) 3 实例覆盖 ai-industry.md v34 §1.3 + risk.md §2.1 ④ 第 6/7 例 + agent.md §2.2 frontier lab × 安全工程 第 6/7 例
BM25 Wins at Scale (arXiv:2607.26497) stephen(ai-industry 增量 3+ llm-application 增量 6) + tom(radar+RAG e1prep) + flyp(deep-read+adversarial) + spark(agent-e1prep §5 边界) + jay(no 显式) 4 实例 + 1 隐含覆盖 rag.md R51 §2.16 RAG 范式规模化对照基线 + ai-industry.md v34 §6 行业 17 足 8-1 补立 + llm-application.md v43 §1.2

2. 缺口(需要人工确认或后续补位)

缺口 影响面 优先级 建议动作
Substack 周度汇总未做(r.jina.ai / jlelse substack / Latent Space / Last Week in AI 等完整覆盖) 评论层与海外 newsletter 覆盖 Jay 2105 已补 swyx 1 条;剩余建议下周一并入
multimodal 活文档 v34 已 96h 未更新,超 3 天红线 24h multimodal 主线活文档滞后 极高 今晚必须启动 v34 → v35 编排窗口(flyp multimodal-e1prep-v35 第一棒已就位 14 件候选增量)
agent 活文档 v37 已就位待编排(spark 8-1 13:30 agent-e1prep 已就位 24h 净增量 6 P0/P1 + 2 P1/P2 + 1 警示 + 1 反方 + 1 状态变化) agent 主线锚点 今晚或明天由 spark 启动 v37 编排
RAG 主线活文档 R50 → R51 待编排(tom 8-1 08:50 rag-e1prep 已就位 R51 3 增量 + 5 件候选) RAG 主线锚点 今晚或明天由 tom 启动
inference 主线活文档待编排(tom 8-1 22:24 inference-e1prep 已就位 6 主线 + 2 旁证 + 1 警示 = 8 件净增量 + 38 件 arXiv 编号) inference 主线锚点 今晚由 tom 启动 inference.md 编排窗口
llm-infra 主线活文档待编排(spark 8-1 18:47 llm-infra-e1prep-v13 已就位 5 主线 + 3 旁证 + 2 警示 + §IX 关键拐点 12 件) llm-infra 主线锚点 今晚由 spark 启动 llm-infra.md 编排窗口(§IX 已 34th 抢修完成版,可直接增量吸收)
risk 主线活文档 R34 → R35 待编排(flyp 8-1 risk-e1prep 已就位 R34 立标固化延续 + 7 条 net-new 增量 + 1 强提醒 + 1 元方法学) risk 主线锚点 今晚或明天由 flyp 启动
llm-application 主线活文档 v42 → v43 待编排(stephen 8-1 21:10 llm-application-e1prep 已就位 8 件净增量 = 5 重大 + 3 旁证) llm-application 主线锚点 今晚由 stephen 启动 llm-application.md 编排窗口
engineering 主线活文档 v41 → v42 待编排(jay 8-1 11:20 engineering-e1prep 已就位 6 增量 + 1105 briefing 5 件 + 1300 briefing 6 件 + 1505 briefing 5 件 + 1735 briefing 4 件 + 2105 briefing 10 件 = ~30 件净增量) engineering 主线锚点 今晚由 jay 启动 engineering.md 编排窗口
ai-industry 主线活文档 v33 → v34 待编排(stephen 8-1 10:21 ai-industry-e1prep 已就位 8 增量 + 12 件 paper_cards 待建卡) ai-industry 主线锚点 今晚由 stephen 启动
HF Daily 8-1 票榜 15 件中 12 件 paper_cards 未建卡(AskChem / Qwen-UI-Agent / PhiZero / Frontis-MA1 / DistillAlign / VideoCoCo / Memory Decoder at Scale / Beacon / BM25 Wins at Scale / Flux-OPD / MPIE-Bench / ACE-Data-0 / Beyond Borrowed Histories) 候选池卡片缺失 今晚 v34 启动前先建卡(特别是 PhiZero + Frontis-MA1 + Memory Decoder at Scale 三大立标候选)
jay 1105 briefing pgvectorscale 471 QPS 数据需在 jay 文中已显式警示("AWS r6id.4xlarge + Cohere Wikipedia 768 维 50M"特定环境不可外推) VecDB 选型共识落地 已显式说明,无需额外动作
Spark dual-rss/chip-huyen "构建生成式 AI 平台的常见组件" / 构建生成式 AI 应用陷阱 平台化层 spark 已隐含在 chip-huyen 1002 RSS 通稿,无需升级

3. 潜在冲突(需要人工确认)

冲突 双方表述 建议处置
Σ-Mem 与 Filesystem-Based Memory 在 RAG §2.17 Memory 架构候选位的归类 tom 已映射到 §2.17 J/Filesystem 已立;Σ-Mem 提议"记忆建模可信赖性路径"作为候选 K;flyp 未在文件系统对立位立标;stephen llm-application 立"第五路信誉记忆 vs 文件 vs 时态图 vs 原生";spark agent-e1prep 立"内化原生 vs 外化可信两套内化路径双立标" 4 视角统一:J = Filesystem;K = Σ-Mem 信任建模;flyp 文件系统 + 信任建模对立位;stephen llm-application §1.3 Memory 第五路候选;保留到 R51/v43/v37 决策
dualG-MRAG 主页归类(rag 主 vs multimodal 主) tom = rag 主 multimodal 副;flyp = rag 主 multimodal 副(与 tom 一致);jay csdn 也按 rag/agent 邻接;stephen ai-industry 邻接;spark agent 邻接 6 视角无冲突,统一 rag 主 multimodal 副
Kimi K3 主线锚点的版本(K3 vs K2.6) stephen ai-industry = K2.5 → K3;jay engineering-filter = K2.5 → K3 跃迁;flyp multimodal = K3 2.8T 5 视角一致,三向
OpenAI GPT-5.6 系列版本号与档位(Sol/Terra/Luna + Codex 档) stephen 1002 news-openai-news 与 sam Altman 周一 X 已对齐;stephen 0910 X radar 也已对齐 无冲突
EU AI Act 2026-08-02 deadline 临门态势 stephen ai-industry Δ2("OpenAI 8-1 主动提前 24 小时完成治理公开表态")与 flyp risk-e1prep("EU AI Act 2026-08-02 倒计时 24h 临门 + OpenAI 主动提前 24h 完成治理公开表态 + Anthropic Glasswing 续接") 不冲突但时间窗口需对齐:stephen 视角为 8-1 上午(deadline 倒计时 36h → 0h),flyp 视角为 8-1 下午(deadline 倒计时 24h → 0h)。建议在 ai-industry.md v34 §1.3 沿用 stephen 时间口径("deadline 倒计时 36h → 0h · 8-1 上午"),footnote 给 flyp 8-1 下午时间口径
GoodServe / AMPD / LAAR / Harvest / Agent Memory / Token-Operations / Workload-Router-Pool / AIConfigurator / Fluid-Guided 在 inference.md vs llm-infra.md 的归类 tom 立 inference.md 主线;spark 立 llm-infra.md 主线;jay 立 engineering.md 主线;stephen llm-application 旁证 1 Agentic 推理三层架构收敛 三视角互补不冲突:建议 inference.md / llm-infra.md / engineering.md 三份活文档同步立标,引用同一 arXiv 编号但视角不同
KV Cache 顶会三件套 (DUAL-BLADE ICDCS 2026 + KV Cache Transform Coding ICLR 2026 + Shadow in the Cache NDSS 2026) 在 llm-infra.md §1.(3) vs risk.md §2.1 的归类 spark 立 llm-infra.md §1.(3) KV cache 14+1 件套新增 + §1.(10) 七大顶会议立标;flyp 立 risk.md §2.1 L0' 元层+dev 风险类目 第 2 例;jay 立 engineering.md 工程复现必备;tom 立 inference.md §2.3 横向参照 四视角互补不冲突:建议 llm-infra.md / risk.md / engineering.md / inference.md 四份活文档同步立标
Σ-Mem trust-modeling-as-attack-surface 三联立与 Filesystem-Based Memory filesystem-as-attack-surface 四联立同时存在 flyp 立"§2.1 C 类立标候选 第 3 拍 + 信任建模 + filesystem 侧分支";spark 立"§2.6 第四十二 f Cyber-Capable + 第四十六 StealthBench + Σ-Mem + Filesystem 形成三联立/四联立" 不冲突(flyp 视角为 risk.md 主线,spark 视角为 agent.md 主线),建议双活文档同步立标
MirrorCode "bootstrapping 工业文明"判断(Jack Clark Import AI) stephen llm-application 增量 3 反方警示 3:作为"专家观点 vs 研究结论"对位;jay engineering-e1prep 警示 4:作为引用观点而非定论处理 2 视角一致,建议在 engineering.md v42 / llm-application.md v43 同步标注"专家观点 vs 研究结论"对位
Lilian Weng "RSI 路径判断"个人观点属性 stephen llm-application 旁证 B 反方警示:v43 §5.3 趋势判断"可能在 2027 成为主线"应在 RSI 部分标注该判断为个人观点;jay engineering-e1prep 警示 3:作为工程观点而非工程事实 2 视角一致,建议在 engineering.md v42 §2.7 / llm-application.md v43 §5.3 同步标注"个人观点"

五、高价值条目候选(按跨实例共识度从高到低,含建议写入路径)

Tier A · 5★ 跨多实例共识度(evening 新增 + 升级)

A1. evening 新增强共识条目

  1. Σ-Mem (arXiv:2607.27958 · 21▲)6 实例 6 文件同源立标饱和(stephen + tom + jay + flyp + spark + paper_cards/683);建议同时入 knowledge/rag.md R51 §2.17 K 候选立标 + knowledge/agent.md v37 §2.2 第六十二节点候选 + knowledge/llm-application.md v43 §1.3 Memory 第五路候选 + knowledge/risk.md §2.1 C 类立标候选 第 3 拍 + trust-modeling-as-attack-surface 三联立首例 + knowledge/ai-industry.md v34 §2 frontier lab 立基础邻接

  2. Filesystem-Based Memory (arXiv:2607.26637 · 21▲)6 实例同源立标饱和;建议 knowledge/rag.md R51 §2.17 J 候选立标 + knowledge/agent.md v37 §2.2 候选新增 L 雏形 + knowledge/risk.md §2.1 C 类立标候选 第 3 拍 + filesystem-as-attack-surface 四联立 + knowledge/llm-application.md v43 §1.3 文件系统记忆沿用

  3. DualG-MRAG (arXiv:2607.28580 · ACM MM 2026)5 实例同源 + 1 隐含;建议 knowledge/rag.md R51 §2 主线 + knowledge/multimodal.md v35 §2.39.x 综述邻接 + knowledge/agent.md v37 §2.2 邻接 + knowledge/llm-application.md v43 §1.2 RAG 工业补全 + knowledge/ai-industry.md v34 §2.137 邻接

  4. GLM-RAG (arXiv:2607.28397)4 实例同源;建议 knowledge/rag.md R51 §2 候选 + knowledge/agent.md v37 §2.2 邻接

  5. MisKnow-Agent (arXiv:2607.20891)5 实例同源;建议 knowledge/risk.md §2.1 L2 接口层风险类目 第 1 例 + deep-research-as-attack-surface 三联立 + knowledge/agent.md v37 §1.4 评测与可靠性邻接 + knowledge/llm-application.md v43 §1.4 评测与可靠性沿用

  6. CoMem (arXiv:2607.28263)4 实例同源;建议 knowledge/multimodal.md v35 §1.2 长上下文 / 长记忆邻接 + knowledge/agent.md v37 §2.2 邻接 + knowledge/rag.md R51 §2.17 候选 L

  7. ConMem (arXiv:2607.28126)4 实例同源;建议 knowledge/rag.md R51 §2.17 候选 L + knowledge/agent.md §2.2 邻接 + knowledge/risk.md §2.1 C 类立标候选 P2 沿用

  8. ShadowDancer (arXiv:2607.28362)2 实例同源;建议 knowledge/multimodal.md v35 §2.39.x 候补级 + knowledge/agent.md §1 主线 7 VLA 邻接

  9. LEDGERMIND (arXiv:2607.28374)2 实例同源;建议 knowledge/multimodal.md v35 §2.39.x 候补级 + knowledge/llm-application.md v43 §1.4 评测与可靠性邻接 + knowledge/risk.md §2.13 MCP 安全危机 邻接

  10. See2Think (arXiv:2607.26769 · 21▲)3 实例同源;建议 knowledge/multimodal.md v35 §1 主线 4 评测方法学新增 + knowledge/llm-application.md v43 §1.4 评测与可靠性 + knowledge/rag.md R51 §2 评测方法邻接

  11. Fairness Pruning (arXiv:2607.28319)4 实例同源;建议 knowledge/evaluation.md R33 §1.4 评测与可靠性 + knowledge/llm-application.md v43 §1.4 + knowledge/risk.md §2.6 沿用 + knowledge/agent.md v37 §1.4 邻接

  12. Shadow in the Cache (arXiv:2508.09442 · NDSS 2026)4 实例同源;建议 knowledge/risk.md §2.1 L0' 元层+dev 风险类目 第 2 例 + knowledge/llm-infra.md §1.(3) KV cache 14+1 件套新增 + knowledge/llm-infra.md §1.(4) Fail-Plausible 五类 + memory-as-attack-surface 第四立标 + knowledge/inference.md §2.3 横向参照

  13. MSR SymCrypt Rust+Lean+Aeneas 形式化验证(生产密码学代码)4 实例同源;建议 knowledge/llm-application.md v43 §1.4 + §3.1 共识 #2 实现层分解 + §5 #9 安全与隐私 + knowledge/engineering.md v42 §2.15 推理工程安全 + knowledge/risk.md §2.6 frontier lab × 安全工程 第 6 例 元方法学跟进 + knowledge/llm-infra.md §1.(10) 沿用

  14. MSR Echoverse 训练 Computer-Use Agent 合成世界3 实例同源;建议 knowledge/llm-application.md v43 §1.1 训练时合成世界层 + knowledge/engineering.md v42 §2.14 ICLR 2026 MemAgents Workshop + knowledge/llm-infra.md §1.(10) 沿用

  15. Lilian Weng Harness Engineering 八元组公式 + 三 design patterns3 实例同源;建议 knowledge/llm-application.md v43 §1.1 + §5 10 项 vs Harness 八元组对照映射 + knowledge/engineering.md v42 §2.7 Agentic Engineering 学科化(理论锚点文章) + knowledge/inference.md §7

  16. ByteByteGo OpenAI ChatGPT Agent 三层架构3 实例同源;建议 knowledge/llm-application.md v43 §1.1 应用架构 + §0 共识层 + §1.4 + §5 #2 #10 + knowledge/engineering.md v42 §2.7 生产实例 + knowledge/inference.md §7

  17. MCP 2.0 stateless 协议4 实例同源;建议 knowledge/llm-application.md v43 §1.1 工具与协议 + §5 #3 状态分层 + knowledge/engineering.md v42 §2.7 + knowledge/inference.md §7 + knowledge/llm-infra.md §1.(4)

  18. MirrorCode Benchmark(METR/Epoch AI 8-1)= 超长程编程任务(数周级)可复现评测3 实例同源;建议 knowledge/engineering.md v42 §2.8 VLDB 2026 Demos + SoK Agentic RAG + knowledge/llm-application.md v43 §1.1 Coding Agent 评测第三档 + §1.4 + §5 #7 + §3.2 争议

  19. FutureAGI LLM Evaluation Tools Guide 2026 = RAG 评测五指标体系3 实例同源;建议 knowledge/llm-application.md v43 §1.2 RAG 工业指标对照 + §1.4 + §5 #5 + §3.1 共识 #5 + knowledge/rag.md R51 §2 + knowledge/evaluation.md R33 §1.4

  20. BM25 Wins at Scale (arXiv:2607.26497 · HF Daily 8-1 #11 38▲) + FutureAGI RAG Reimagined4 实例 + 1 隐含覆盖;建议 knowledge/rag.md R51 §2.16 RAG 范式规模化对照基线 + knowledge/ai-industry.md v34 §6 行业 17 足 8-1 补立 + knowledge/multimodal.md v35 §1.3 邻接 + knowledge/llm-application.md v43 §1.2 + §3.2 争议 #2

A2. evening 新增 inference 系统论文立标(tom inference-e1prep 6 主线)

  1. GoodServe arXiv:2605.16867 = Agentic LLM 推理的 E2E-SLO Goodput 调度3 实例同源(tom + spark + jay);建议 knowledge/inference.md §2.2 调度 + §7 Agent 生产推理 + knowledge/llm-infra.md §1.(2) 调度 9 学派邻接 + knowledge/engineering.md §2.95 evaluation discipline 邻接

  2. AMPD arXiv:2602.14516v2 = Multi-round Disaggregated LLM Serving(ReAct Agent 场景专项)3 实例同源;建议 knowledge/inference.md §2.2 调度 Disagg 5 节点扩展 + knowledge/llm-infra.md §1.(2) 邻接 + knowledge/engineering.md §2.13 选型决策树

  3. LAAR arXiv:2604.15732v1 = Long-Context-Aware NUMA-Aware 分布式 LLM 路由(GH200 实测)2 实例同源(tom + jay engineering-filter);建议 knowledge/inference.md §2.2 调度 + §2.10 系统栈 + knowledge/llm-infra.md §1.(2) 邻接

  4. Token-Operations Oriented Inference Optimization arXiv:2606.20295v1 四层架构(含 P-EAGLE/MeanCache/Cortex/140T tokens/day 中国数据)1 实例单源(tom inference-e1prep + jay 1950 briefing 邻接);建议 knowledge/inference.md §2.5 或新增 §2.11 推理优化全景图节

  5. Harvest arXiv:2602.00328v1 = P2P GPU Cache 共享(生产集群 GPU 利用率 43.48% 实证)2 实例同源(tom + jay 1950 briefing);建议 knowledge/inference.md §2.3 KV cache 14 件套新增 + knowledge/llm-infra.md §1.(3) KV cache 14+1 件套新增

  6. Agent Memory arXiv:2603.04428v1 = Edge 设备 Q4 KV Cache 持久化(15.7s / 78.5s dead time 实测)2 实例同源(tom + jay 1950 briefing);建议 knowledge/inference.md §2.3 KV cache + §7 Agent 生产推理 + knowledge/llm-infra.md §1.(3) 邻接

A3. evening 新增 frontier lab × 治理 / 安全 / 综述 / 行业延伸

  1. OpenAI 8-1「Advancing Responsible AI Across Europe」+ Anthropic 8-1 Project Glasswing + EU AI Act 8-2 24h 临门3 实例同源(stephen + flyp + spark);建议 knowledge/ai-industry.md v34 §1.3 frontier lab × 治理 EU AI Act 8-2 deadline 临门联动手独立小节 + knowledge/risk.md §2.1 ⑧ P0 监管 24h 临门 + frontier lab × 监管治理 × 国际协作 三栖对位 8-1/8-2 联动 第 1 例 + knowledge/agent.md v37 §3.2 警示沿用

  2. OpenAI 8-1 捣毁柬埔寨诈骗犯罪团伙 + OpenAI HF 模型评估安全事件 + HF 加入 Open Secure AI Alliance + Anthropic 8-1 YT Project Glasswing + MSR SymCrypt 形式化验证5 视角合流(stephen + flyp + spark + tom inference 邻接 + jay engineering 邻接);建议 knowledge/ai-industry.md v34 §1.3 + §2.114.x + §2 frontier lab × 安全工程 第 4-6 立家 + knowledge/risk.md §2.1 ④ 第 6/7/8 例 + §2.6 frontier lab × 安全工程 第 6 例 元方法学跟进

  3. OpenAI ChatGPT Agent 三层架构(ByteByteGo 8-1 访谈)= Harness/API/Inference 三层职责分离的具体技术实现3 实例同源;建议 knowledge/llm-application.md v43 §1.1 + §0 共识层 + §1.4 + §5 #2 #10

  4. MSR SymCrypt Rust+Lean+Aeneas 形式化验证 = 主动形式化验证 vs 被动漏洞补丁 双立标第 2 例4 实例同源;建议 knowledge/risk.md §2.6 frontier lab × 安全工程 第 6 例 元方法学跟进 = 攻守双向补全的工程化样板

A4. evening 新增数据库 / 后端 / 云原生 / VecDB 立标(jay 1105/1300/1505/1735/1950/2105 briefing)

  1. Bespoke OLAP arXiv:2603.02001 · ICLR 2026 接收 + UC Berkeley ADRS Blog = 工作负载特化 OLAP 引擎(CEB 51.40× speedup)1 实例单源(jay 2105 briefing D1);建议 knowledge/engineering.md v42 §2.8 + 数据库活文档新增 + knowledge/llm-application.md v43 §1.1 训练时合成世界层 邻接

  2. GenDB arXiv:2603.02081 = 基于代码生成的下一代 Query Processing 系统(对比 DuckDB v1.4.4 / ClickHouse / Umbra)1 实例单源(jay 2105 briefing D2);建议 knowledge/engineering.md v42 §2.8

  3. HotPrefix ACM SIGMOD 2026(论文 3749168)+ CoDec + AlignedServe = 热度感知的 KV Cache 调度 + 前缀共享 + Prefix-aware Batching1 实例单源(jay 2105 briefing D3);建议 knowledge/inference.md §2.3 + §2.2 调度 沿用 + knowledge/llm-infra.md §1.(3) KV cache 14+1 件套新增 SIGMOD 2026 三件套

  4. pgvector 0.9 / Qdrant v1.14 / Milvus 2.6 / Weaviate v1.37 / Pinecone 2026 向量数据库决策矩阵1 实例单源(jay 2105 briefing D4 + jay 1105 briefing D1 pgvectorscale 471 QPS);建议 knowledge/engineering.md v42 §2.13 选型决策树更新 + knowledge/rag.md R51 §3 选型决策矩阵

  5. llm-d v0.7.0 正式加入 CNCF Sandbox(KubeCon EU 2026)+ EPP 整合 + Inference Scheduler 新增初始 EPD(Prefill-Decode Disaggregation)1 实例单源(jay 2105 briefing B1);建议 knowledge/llm-infra.md §1.(10) SIGMOD 2026 三件套 沿用 + 新增 CNCF llm-d + Kthena

  6. Kthena:CNCF Volcano 子项目,LLM 推理路由编排系统(拓扑感知调度 + KV Cache 感知路由 + PD Disaggregation)1 实例单源(jay 2105 briefing B2);建议 knowledge/llm-infra.md §1.(10) 新增 Kthena

  7. Memory-Disaggregated LLM Inference HotInfra '26(ISCA 2026 workshop · CXL KV Cache + PIM-DIMM · DeepSeek-R1-671B 32K token 生成 · 39.7× cost reduction)1 实例单源(jay 2105 briefing B3);建议 knowledge/inference.md §2.3 KV cache 14 件套新增 CXL + knowledge/llm-infra.md §1.(3) KV cache 14+1 件套新增

  8. LLM 推理指纹攻击 & CVE 威胁面(arXiv:2605.29979v1 + CVE-2026-22778 vLLM + CVE-2026-27893 vLLM + CVE-2026-5760 SGLang)1 实例单源(jay 2105 briefing B4);建议 knowledge/risk.md §2.1 ⑥ L0' 元层+dev 风险类目 第 3 例 + knowledge/llm-infra.md §1.(4) Fail-Plausible

  9. vLLM vs SGLang 2026 关键定量数据(H100 SXM5 80GB + H200 + APC on/off + YottaLabs/Spheron/DeployBase 三源)1 实例单源(jay 2105 briefing B5 + jay 1735 briefing D1);建议 knowledge/llm-infra.md §1.(1) 推理引擎选型决策树更新

  10. AI Agents Stack 2026 版(The AI Engineer Substack · swyx + Alessi · ~80K 订阅)= Memory 一等公民 + Context Engineering 取代 Prompt Engineering + MCP 标准化 + Agent Stack 六层架构1 实例单源(jay 2105 briefing C1);建议 knowledge/llm-application.md v43 §1.1 + §1.3 + §1.2 + knowledge/agent.md v37 §1.1 + knowledge/ai-industry.md v34 §2.114 Substack 邻接

Tier B · 4★ 单实例高深度

B1. AI Engineer 1000+ JD 需求(jay 1735 briefing D5/D6)

  • LLM Engineer vs AI Engineer vs GenAI Engineer 角色分层 — jay 单实例;建议 knowledge/ai-industry.md v34 §2 frontier lab 人才市场 邻接 + knowledge/engineering.md v42 §6.3 锚点体系

B2. HF Training Agents 3(RL 训练智能体系列)+ HF 加入 Open Secure AI Alliance(stephen + flyp + spark)

  • stephen 0910 X radar + flyp risk-e1prep 增量 6 + spark agent-e1prep;建议 knowledge/agent.md v37 §1.1 Harness 训练时 邻接 + knowledge/ai-industry.md v34 §2.114.x

B3. Yann LeCun AMI Labs $1.03B 融资(stephen 0910 X radar + ai-industry 增量 6)

  • researcher-driven frontier 路线第 3 例(Thinking Machines + SSI + AMI Labs 三联立);建议 knowledge/ai-industry.md v34 §2.66 researcher-driven frontier 路线三联立独立子节

B4. Hugging Face 8-1 blog 5 件(OlmoEarth · LFM2.5-Encoders · Cosmos-H-Dreams · Agent 入侵事件技术时间线 · GPU 管理)

  • 美国厂商基础设施 5 件集中;建议 knowledge/ai-industry.md v34 §2.66 + §2.114 + §1 主线 7 VLA 飞轮(NVIDIA Cosmos-H-Dreams 第 2 家机器人仿真)+ §2 x86 Hack

B5. HF Daily 8-1 票榜 5 件新鲜榜首 + Metis 240▲ 重返

  • AskChem 285▲ / Qwen-UI-Agent 265▲ / Metis 240▲ / PhiZero 150▲ / Frontis-MA1 144▲;建议 knowledge/ai-industry.md v34 §2.137.1 8-1 票榜 5 件新鲜榜首独立子目 + knowledge/multimodal.md v35 §6 行业 8 主线 Qwen-UI-Agent 国内 GUI Agent 立标

B6. vLLM/SGLang H100 + H200 + GB300 NVL72 25× 推理性能提升(jay 1735 briefing D1)

  • SGLang 2026 上半年快速追赶 + GB300 NVL72 rack-scale + MXFP4 量化格式;建议 knowledge/llm-infra.md §1.(1) 推理引擎选型决策树更新

B7. DUAL-BLADE ICDCS 2026 + KV Cache Transform Coding ICLR 2026 + Shadow in the Cache NDSS 2026 七大顶会议 KV-cache 集中爆发(spark llm-infra-e1prep)

  • spark 单实例;建议 knowledge/llm-infra.md §1.(3) KV cache 14+1 件套新增 DUAL-BLADE + Transform Coding + Shadow in the Cache + knowledge/llm-infra.md §1.(10) 七大顶会议 KV-cache 集中爆发立标

B8. Microsoft Echoverse + Open Secure AI Alliance + SymCrypt 元方法学跟进

  • MSR 单实例双立标;建议 knowledge/risk.md §2.6 frontier lab × 安全工程 第 6 例 元方法学跟进 + knowledge/llm-application.md v43 §1.4 + §5 #9

Tier C · 3★ 数据点 / 行业新闻

  1. LlamaParse 智能路由 · PDF 解析成本降 50-90%(jay 1050-1240) — 工程化层
  2. LFM2.5-Encoders · CPU 长文本编码器 3.7× ModernBERT(stephen 1003 HF blog) — 工程化层
  3. pgvectorscale 471 QPS @ 99% recall · 11.4× Qdrant(jay 1105 briefing) — VecDB 选型
  4. Kimi K3 2.8T 原生视觉 · BenchLM 多模态/Grounded #2/32 89.6/100(stephen + jay + flyp 三实例覆盖但具体视角不同)
  5. DeepSeek-V4-Flash-0731 + Solar-Open2-250B + Qwen-UI-Agent 265▲ 三连开源(jay 0950 + stephen 1004) — 国内主线立标
  6. Anthropic Project Glasswing(8-1 YT) — ai-industry.md v34 §1.3 邻接
  7. HF Training Agents 3(强化学习训练智能体系列)(7-28 HF blog) — ai-industry.md agent 邻接
  8. Open Secure AI Alliance · HF 加入 NVIDIA 牵头联盟(7-27 HF blog) — ai-industry.md 治理邻接
  9. Thinking Machines Inkling-Small 7-31 + Inkling 7-16 两档策略ai-industry.md v34 §2.66 frontier lab 模型档位策略独立小节
  10. OpenAI Abundant Intelligence 8-1 新战略口号(待核实) — ai-industry.md v34 §2.140 沿用

六、分类标签汇总(evening 完整态)

agent:
  - Sigma-Mem Online Reliability Memory (multi-agent trust memory)
  - Filesystem-Based Memory (filesystem-default agent memory)
  - MisKnow-Agent (along R50)
  - Inkling-Small + Inkling two-tier
  - ByteByteGo ChatGPT Agent Loop three-tier (harness+API+inference)
  - Lilian Weng Harness Engineering eight-tuple formula + three design patterns
  - MirrorCode Benchmark (METR/Epoch AI)
  - Project Glasswing (Anthropic software safety)
  - Anthropic cybersecurity 3-real-incident disclosure
  - Mythos HAWK/AES cryptographic weaknesses
  - Anthropic AI for Science rare-disease grants $50K
  - HF Training Agents 3 (RL on local/open weights)
  - Open Secure AI Alliance (NVIDIA + Anthropic + Google + HF)
  - Microsoft Echoverse (synthetic world training)
  - Microsoft SymCrypt Rust+Lean+Aeneas formal verification
  - sigma-mem candidate K (memory trust modeling)
  - filesystem candidate J (filesystem-default agent memory)
  - AI Agents Stack 2026 Edition (swyx + Alessi Substack)
  - Memory-as-attack-surface #1 (Metis) / #2 (StealthBench) / #3 (Cyber-Capable)
  - Trust-modeling-as-attack-surface three-link (Σ-Mem + Cyber-Capable + StealthBench)
  - Filesystem-as-attack-surface four-link (Filesystem + Σ-Mem + Cyber-Capable + StealthBench)
  - Deep-research-as-attack-surface three-link (MisKnow-Agent + Cyber-Capable + StealthBench)

rag:
  - BM25 Wins at Scale (RAG paradigm scaling counter)
  - DualG-MRAG multimodal rag decoupling
  - GLM-RAG Graph Language Model retriever
  - ConMem contribution-aware memory manufacturing
  - See2Think intermediate visual states benchmark (rag邻接)
  - OmniScope, Fairness Pruning (radar other candidates)
  - DeepDiver (omitted by jay 0821 csdn)
  - VisionRAG (no-OCR image-level indexing)
  - GraphRAG + AgenticRAG 2026 practical chain
  - pgvector 0.9 / pgvectorscale 471 QPS (jay 1105 briefing)
  - pgvector 0.9 / Qdrant / Milvus / Weaviate / Pinecone 2026 decision matrix (jay 2105 briefing)
  - 20 Advanced RAG Types (Future AGI / Turing Post) (jay 2105 briefing)
  - FutureAGI RAG Reimagined 5 Breakthroughs (GradientFlow Substack + Douwe Kiela + Nvidia OP-RAG)
  - FutureAGI RAG 五指标体系 (Chunk Utilization + Attribution + Context Relevance + Context Precision + Faithfulness)

multimodal:
  - ShadowDancer shadow learning world model
  - CoMem deep-role-division unbounded context
  - LEDGERMIND evidence ledger traceable inference
  - See2Think VAoT diagnostic
  - Kimi K3 2.8T native vision BenchLM #2/32
  - Qwen-UI-Agent 265 (GUI foundation)
  - Gemini Robotics 2 (GoogleDeepMind 7-30 rerun)
  - DeepMind On-Device 2 + ER 2 video understanding
  - Apptronik Apollo 2 joint demo
  - Visual Patch World world-model-third-paradigm
  - ActiveVision + Trace + Show Don't Tell (four-metric cluster)
  - PhiZero physical language world model (HF Daily 8-1 150▲)
  - Qwen-UI-Agent GUI foundation Agent (HF Daily 8-1 265▲)

engineering / systems:
  - ByteByteGo agent loop three-tier
  - Lilian Weng Harness Engineering eight-tuple formula + three patterns
  - MirrorCode benchmark
  - LlamaParse intelligent routing (50-90% cost cut)
  - LFM2.5-Encoders CPU 3.7x ModernBERT
  - pgvectorscale 471 QPS 11x Qdrant
  - CIDR 2026 PostgreSQL decoupled vector search
  - LanceDB embedded zero-server
  - vLLM speculative decoding source-code analysis
  - DeepSeek-V4-Flash-0731 / Solar-Open2-250B deployment
  - Kimi K3 2.8T MXFP4 quantization deployment
  - SymCrypt Rust verification + Echoverse (MSR)
  - Harness Engineering for Self-Improvement (Lilian Weng)
  - Simon Willison MCP 2.0 stateless HTTP format + uvx mcp-explorer
  - Bespoke OLAP ICLR 2026 51.40× speedup
  - GenDB next-generation query processing
  - HotPrefix SIGMOD 2026 hotness-aware KV cache
  - llm-d v0.7.0 CNCF Sandbox + Kthena Volcano subproject
  - CXL Memory-Disaggregated HotInfra 2026 39.7× cost reduction
  - LLM fingerprinting attack + CVE-2026-22778/27893/5760
  - vLLM vs SGLang H100/H200/GB300 2026 quantitative data
  - AI Agents Stack 2026 Edition (swyx Substack)

inference / llm-infra:
  - GoodServe arXiv:2605.16867 E2E-SLO goodput scheduling
  - AMPD arXiv:2602.14516v2 multi-round PD disaggregation
  - LAAR arXiv:2604.15732v1 NUMA-aware long-context routing GH200
  - Token-Operations Oriented Inference Optimization arXiv:2606.20295v1 four-tier
  - Harvest arXiv:2602.00328v1 P2P GPU cache 43.48% utilization
  - Agent Memory arXiv:2603.04428v1 Edge Q4 KV cache persistence
  - MCP 2.0 + Lilian Weng Harness + ByteByteGo OpenAI Agent Loop = Agentic 推理三层架构收敛
  - SuperInfer arXiv:2601.20309v2 GH200 superchip inference
  - KernelSight-LM arXiv:2606.28565v1 kernel-level inference simulator
  - KV Cache 顶会三件套 (DUAL-BLADE ICDCS 2026 + KV Cache Transform Coding ICLR 2026 + Shadow in the Cache NDSS 2026)
  - 七大顶会议 KV-cache 集中爆发立标 (SIGMOD + SIGCOMM + HPCA + ACL + ICDCS + ICLR + NDSS)

risk:
  - Shadow in the Cache arXiv:2508.09442 NDSS 2026 KV-cache privacy/side-channel (P0 警示)
  - Σ-Mem arXiv:2607.27958 trust-modeling-as-attack-surface three-link (P1)
  - Filesystem-Based Memory arXiv:2607.26637 filesystem-as-attack-surface four-link (P1)
  - MisKnow-Agent arXiv:2607.20891 deep-research-as-attack-surface three-link (P1)
  - EU AI Act 2026-08-02 deadline 24h 临门 (P0 监管)
  - OpenAI 8-1 捣毁柬埔寨诈骗犯罪团伙 (P2)
  - HF 加入 Open Secure AI Alliance (P3 第 4 立家)
  - MSR SymCrypt Rust 形式化验证 (P3 元方法学跟进)
  - R34 §2.1 ① StealthBench P0 沿用
  - R34 §2.1 ② Metis P1 沿用 + 第 3 拍
  - R34 §2.1 ③ Memory for LLMs 综述 P1 沿用
  - R34 §2.1 ④ Graph-Native Bitemporal P1 沿用 + Anthropic 7-30 沿续
  - R34 §2.1 ⑥ CVE-2026-22778 vLLM CVSS 9.8 P0 + Shadow in the Cache 第 2 例
  - R34 §2.1 ⑦ Opus 4.7 三起真实系统攻击 P0 沿用
  - R34 §2.1 ⑧ Opus 5 + EU AI Act 8-2 临门 + frontier lab × 监管 × 国际协作 三栖对位 第 1 例
  - R34 §2.x Cyber-Capable AI Agents P2 沿用 + filesystem/trust-modeling/deep-research 三联立/四联立
  - frontier lab × 安全工程 #6/#7/#8 例 + 第 4 立家
  - α 14 维 + 反身性 21 轨 + 防御表 78 → 82 行

substack / industry weekly:
  - r.jina.ai / jlelse substack / Latent Space (swyx) / Last Week in AI (week-31 summary missing)
  - jamwithai infrastructure RAG FastAPI stack
  - interconnects Nathan Lambert (Decoding AI)
  - cameron-wolfe Substack
  - chip-huyen pitfalls + agents + genai-platform
  - gradient-flow specialized-AI + data-center-economics
  - **AI Agents Stack 2026 Edition (swyx + Alessi Substack, 80K 订阅)** (jay 2105 briefing C1 evening 新增)
  - The AI Engineer Substack swyx 80K 订阅
  - AI Engineer 1000+ JD 角色分层 (jay 1735 briefing D5/D6)

database / backend / cloud-native:
  - Bespoke OLAP ICLR 2026 (workload-specialized synthesis, 51.40× speedup)
  - GenDB next-generation query processing (LLM code generation)
  - HotPrefix SIGMOD 2026 (hotness-aware KV cache scheduling + prefix sharing)
  - pgvector 0.9 / pgvectorscale 471 QPS @ 99% recall
  - Qdrant v1.14 / Milvus 2.6 / Weaviate v1.37 / Pinecone 2026 决策矩阵
  - llm-d v0.7.0 CNCF Sandbox + Kthena Volcano subproject
  - CXL Memory-Disaggregated HotInfra 2026 39.7× cost reduction
  - vLLM/SGLang H100/H200/GB300 2026 定量数据 + CVE-2026-22778/27893/5760

七、建议写入路径(按 GitHub-ready 草稿要求)

不直接写 published/,等统一同步任务处理。本稿只列出"建议路径 + 内容大纲"。

7.1 主线活文档(按共享知识库写入规则)

路径建议 内容大纲 来源实例
knowledge/ai-industry.md v33 → v34 升级 8 条增量(Inkling-Small + OpenAI EU 治理 + HF Daily 8-1 票榜 + HF blog 5 件 + Anthropic 网络安全 3 起事件 + Glasswing + Inkling-Small + HF Training Agents 3)+ 主线 §1.3 治理新增「EU AI Act 8-2 临门联动手」独立小节 + 4 主线候选升档 = 主线 (177)-(180) Stephen
knowledge/rag.md R50 → R51 接力 9 件候选(Σ-Mem / Filesystem / DualG-MRAG / GLM-RAG / ConMem / See2Think / BM25 / OmniScope / FairnessPruning)+ §2.17 候选 J/K/L 三件记忆架构新立 + §2.16 RAG 范式规模化对照基线升级 + §2 主线多模态 RAG 重申 Tom
knowledge/multimodal.md v34 → v35 接力 14 件候选增量(See2Think + ShadowDancer + LEDGERMIND + CoMem + DualG-MRAG + Kimi K3 + 7 延伸追踪)+ 评测方法学二十三面体四联升级到五联("答案接口 + 任务设计 + 训练环境 + 中间产物使用 + 证据账本")+ 主线 2 长上下文邻接 CoMem Flyp
knowledge/engineering.md v41 → v42 接力 ~30 条增量(6 条 engineering-e1prep + 5 条 1105 briefing + 6 条 1300 briefing + 5 条 1505 briefing + 4 条 1735 briefing + 10 条 2105 briefing)+ §2.7 Agentic Engineering 学科化补 ByteByteGo 三层架构生产实例 + 6 engineering MirrorCode benchmark + §2.95 evaluation discipline 新增 + §2.13 选型决策树更新 + §2.15 推理工程安全补 SymCrypt + §2.8 VLDB 2026 Demos 补 Bespoke OLAP/GenDB + §2.14 ICLR 2026 MemAgents Workshop 补 MSR Echoverse Jay
knowledge/llm-application.md v42 → v43 接力 8 件净增量(5 重大 + 3 旁证)= ByteByteGo 三层架构 + MSR Echoverse + MirrorCode + FutureAGI 五指标 + Fairness Pruning + BM25/OP-RAG + SymCrypt 形式化验证 + MCP 2.0 stateless + Σ-Mem 第五路 Memory + Lilian Weng 八元组 + Mythos 密码学 + AI Agents Stack 2026 Edition (swyx Substack 80K 订阅) Stephen
knowledge/inference.md 升级(tom 维护) 8 件净增量(6 主线 + 2 旁证)= GoodServe E2E-SLO goodput + AMPD Multi-round PD 分 离 + LAAR NUMA-aware long-context routing + Token-Operations 四层架构 + Harvest P2P GPU cache + Agent Memory Edge Q4 KV + MCP 2.0 + Lilian Weng Harness + ByteByteGo OpenAI Agent Loop + SuperInfer GH200 + KernelSight-LM + KV Cache 顶会三件套(沿用 llm-infra.md) Tom
knowledge/llm-infra.md 升级(spark 维护) 7 主线 + 3 旁证 + 2 警示 = KV Cache 顶会三件套 + Agentic Serving 三件套 + AIConfigurator + Fluid-Guided + 推理引擎 4 选 1 + MCP 2.0 + MSR Echoverse + MSR SymCrypt + §IX 关键拐点 12 件 Spark
knowledge/risk.md R34 → R35 接力 7 条 net-new 增量 + 1 强提醒 + 1 元方法学 = Shadow in the Cache NDSS P0 + Σ-Mem trust-modeling-as-attack-surface 三联立 + Filesystem filesystem-as-attack-surface 四联立 + MisKnow-Agent deep-research-as-attack-surface 三联立 + EU AI Act 8-2 24h 临门 + OpenAI 8-1 捣毁 + HF Open Secure AI Alliance + MSR SymCrypt + frontier lab × 安全工程 第 6/7/8 例 + 第 4 立家 + α 14 维 + 反身性 21 轨 + 防御表 78 → 82 行 Flyp
knowledge/agent.md v36 → v37 接力 6 件 P0/P1 立标候选 + 2 件 P1/P2 邻接 + 1 件警示 + 1 件反方 + 1 件状态变化 = Σ-Mem + Filesystem + DualG-MRAG + GLM-RAG + MisKnow-Agent + ConMem + CoMem + ByteByteGo 三层架构 + Lilian Weng Harness Engineering + MirrorCode + MSR Echoverse + MSR SymCrypt + Simon Willison MCP 2.0 + OpenAI 8-1 捣毁诈骗犯罪 + Project Glasswing + Open Secure AI Alliance + EU AI Act 8-2 deadline 临门 Spark

7.2 review / metadata / digests

路径建议 内容 来源
/shared/research-kb/review/2026-08-01-evening-coverage.md 本协调稿精简版(仅保留覆盖度 + Tier A/B + 冲突 + 缺口 + 写入路径) Stephen
/shared/research-kb/metadata/coverage-matrix-2026-08-01-evening.md 十向覆盖度矩阵 + 冲突表 + 缺口表(一表式) Stephen
/shared/research-kb/digests/2026-08-01-stephen-evening.md 同上 Stephen

7.3 inbox 草稿(已写入)

路径(实际写入) 大小 状态
/shared/research-kb/inbox/stephen/2026-08-01-1245-stephen-coordination-check-noon.md ~25 KB ✅ 已写入
/shared/research-kb/inbox/stephen/2026-08-01-2245-stephen-coordination-check-evening.md ~28 KB ✅ 本稿即此

八、是否需要精读 / 审稿 / 主题页更新

8.1 需要精读(PDF 全文 / 跨代对照)

必做动作 时限
arXiv:2607.26497 BM25 Wins at Scale PDF 全文 + Reader sensitivity 3+ 档 + 生产 harness 对照 + 跨语料外推 8-1 → 8-5
arXiv:2607.26637 Filesystem-Based Memory PDF 全文 + 5 RQ 全部核 + 50/100/200 session 长期 horizon 曲线 8-1 → 8-5
arXiv:2607.28580 DualG-MRAG PDF 全文 + HM-RAG/MMAgent-R² head-to-head + AcademicEval 对照 8-1 → 8-5
arXiv:2607.28397 GLM-RAG PDF 全文 + 评测设计验证 + DualG-MRAG 对照 8-2 → 8-6
arXiv:2607.27958 Σ-Mem PDF 全文 + 在 AgentLoom / MCTS-RAG 上的对照 + paper_cards/683 已建 8-2 → 8-6
arXiv:2607.28126 ConMem PDF 全文 + 工业场景复现路径 8-3 → 8-7
arXiv:2607.26769 See2Think PDF 全文 + VAoT 可解释性方法依赖 + 跨模态覆盖度验证 8-1 → 8-5
arXiv:2607.28362 ShadowDancer PDF 全文 + 演示视频采集成本披露 + 跨动力学鲁棒性 8-3 → 8-7
arXiv:2607.28263 CoMem PDF 全文 + 在开箱即用模型 + MLLM 上的实证 8-3 → 8-7
arXiv:2607.28374 LEDGERMIND PDF 全文 + 多模态工具统一表达评估 8-3 → 8-7
arXiv:2508.09442 Shadow in the Cache NDSS 2026 KV-cache 隐私/侧信道(paper_cards ⚠️ 未建卡,优先级最高)+ 缓解方案具体实现 + vs CVE-2026-22778 vLLM 修复路径 + vs SafeKV+PrefixWall 关系 head-to-head + vs MCP 2.0 authorization hardening 集成路径 8-2 立即
arXiv:2605.16867 GoodServe PDF 全文 + GPU 异构资源下最大化 goodput 的在线调度框架 8-2 → 8-6
arXiv:2602.14516v2 AMPD PDF 全文 + vs Dynamo 静态分离 head-to-head + SWE-Bench/BFCL 验证 8-2 → 8-6
arXiv:2604.15732v1 LAAR PDF 全文 + numactl NUMA 亲和性 + Envoy EPP 接入 llm-d MaxScorePicker + GH200 NVL2 实测 8-2 → 8-6
arXiv:2606.20295v1 Token-Operations PDF 全文 + 四层架构 + P-EAGLE/MeanCache/Cortex 2026 新技术 + 140T tokens/day 中国数据 8-2 → 8-6
arXiv:2602.00328v1 Harvest PDF 全文 + FlexPipe 两大云厂商两周实测 + DeepSeekV3/Mistral-Large-3-675B/Kimi-K2 传输时间 8-2 → 8-6
arXiv:2603.04428v1 Agent Memory PDF 全文 + Edge Q4 KV Cache + vllm-mlx 21-87% vs llama.cpp + 78.5s dead time 8-2 → 8-6
arXiv:2601.20309v2 SuperInfer PDF 全文 + GH200 KV cache offloading + NVLink-C2C 8-3 → 8-7
arXiv:2606.28565v1 KernelSight-LM PDF 全文 + GB200 Tier B vs AIConfigurator + Vidur 对比 8-3 → 8-7
arXiv:2511.01815 KV Cache Transform Coding PDF 全文 + 相对 KVQuant 6× 的精度损失曲线 + ICLR 2026 论文 8-2 → 8-6
arXiv:2604.26557 DUAL-BLADE PDF 全文 + ICDCS 2026 + prefill -33.1% / decode -42.4% / SSD 2.2× 8-2 → 8-6
arXiv:2603.02001 Bespoke OLAP PDF 全文 + ICLR 2026 + TPC-H 12.35× / CEB 51.40× speedup + UC Berkeley ADRS 8-2 → 8-6
arXiv:2605.29979v1 LLM Fingerprint PDF 全文 + 2026 CVE-2026-22778/27893/5760 攻防 8-3 → 8-7
arXiv:2603.02081 GenDB PDF 全文 + DuckDB v1.4.4/ClickHouse v26.2.1/Umbra/MonetDB/PostgreSQL v18.2 8-3 → 8-7

8.2 需要审稿(反方)

  • flyp 8-1 10:30 周六精读 + 反方审稿(已就位 6 条证伪线 / 件)
  • 本协调稿已在 §四 列出"潜在冲突"10 条,全部需人工确认
  • stephen llm-application-e1prep 列出 12 条反方警示 + jay engineering-e1prep 列出 5 条警示 + tom inference-e1prep 列出 6 条警示 + flyp risk-e1prep 列出 8 条待核实说法 = 31 条反方/警示需统一回访

8.3 主题页更新(活动 v34/v35/v41/v42/...窗口编排)

主题页 上次更新 距今 是否需要编排 建议
ai-industry v33 7-31 22:45 CST ~24h ✅ 启动 v34 编排 今晚由 stephen 启动
rag R50 8-1 凌晨 ~22h ✅ 启动 R51 编排 今晚或明天由 tom 启动
multimodal v34 7-28 08:40 CST ~110h ✅ 启动 v35 编排(已超 3 天红线 38h) 今晚由 flyp 启动(最紧迫)
engineering v41 7-31 17:35 CST ~29h ✅ 启动 v42 编排 今晚由 jay 启动
LLM application v42 8-1 11:20 CST ~11h ✅ 启动 v43 编排 今晚由 stephen 启动
inference 8-1 22:24 CST ~0.5h ✅ 启动新版本编排 今晚由 tom 启动
llm-infra 7-31 18:47 CST ~28h ✅ 启动新版本编排(§IX 关键拐点 12 件已就位) 今晚由 spark 启动
risk R34 8-1 00:30 CST ~22h ✅ 启动 R35 编排 今晚或明天由 flyp 启动
agent v36 7-31 16:20 CST ~30h ✅ 启动 v37 编排 今晚或明天由 spark 启动

编排优先级(按紧迫度从高到低): 1. multimodal v34 → v35(超 3 天红线 38h,最紧迫) 2. engineering v41 → v42(饱和增量 ~30 件) 3. llm-application v42 → v43(8 件净增量 + 跨实例共识度极高) 4. inference / llm-infra(双活文档同步升级,6+5 主线) 5. ai-industry v33 → v34(12 件 paper_cards 待建卡) 6. risk R34 → R35(7 条 net-new + memory-as-attack-surface 体系扩展) 7. agent v36 → v37(6 P0/P1 + 2 P1/P2 + 1 警示) 8. rag R50 → R51(9 件候选 + §2.17 J/K/L)


九、本稿状态

  • ✅ 本稿即写入 /shared/research-kb/inbox/stephen/2026-08-01-2245-stephen-coordination-check-evening.md
  • ⚠️ 暂未写入 published/ · 未执行 git commit / push / gh pr
  • 📌 Substack 周度缺口 = 下次启动素材(已部分补 swyx 1 条)
  • 📌 9 条主线活文档编排窗口建议今晚统一启动(特别是 multimodal 已超 3 天红线 38h · 最紧迫)
  • 📌 HF Daily 8-1 票榜 15 件中 12 件 paper_cards ⚠️ 未建(特别是 PhiZero + Frontis-MA1 + Memory Decoder at Scale 三大立标候选)
  • 📌 Shadow in the Cache arXiv:2508.09442 NDSS 2026 paper_cards ⚠️ 未建(风险主线 P0 警示优先级最高)

十、最后一句话

今天 5 实例合计 ~35 篇新草稿(evening 部分),跨 10 主线(agent/rag/multimodal/engineering/systems/csdn/substack/risk/llm-application/llm-infra)覆盖度均达"极高",9 条主线活文档编排窗口今晚待启动(特别是 multimodal 已超 3 天红线 38h · 最紧迫),31 条反方/警示需统一回访12 件 HF Daily 8-1 票榜 + 1 件 Shadow in the Cache paper_cards 缺失待补建3 项新增立标信号需在 v34/v35/v42/v43 同步落点(KV Cache 顶会三件套 + Agentic Serving 调度三件套 + Frontier lab × 监管/安全/治理 联动)。Anan 收到本稿后,建议优先关注 §三(十向覆盖度)+ §四(冲突 + 缺口)+ §八.3(编排优先级),决定哪些主题活文档窗口今晚启动、哪些留到明天。