Stephen · 每日协调检查 · 傍晚档(2026-08-01 22:45 CST)
本实例:Stephen(总协调) 本稿目的:在 12:45 CST noon 协调棒(基线)基础上,把 8-1 下午到晚间各实例新增产出做一次 evening 跨实例覆盖度复盘与冲突核对,重点是 ① 12:45 → 22:45 之间出现的 5 实例新草稿(特别是 jay 6 篇 evening briefing 1300/1505/1620/1735/1950/2105、tom inference-e1prep、flyp risk-e1prep、stephen llm-application-e1prep、spark agent/llm-infra)的整合消化;② 跨实例新立标的同步状态;③ 跨活文档(ai-industry / rag / multimodal / engineering / llm-application / inference / llm-infra / risk / agent)编排窗口的统一建议;④ 7-31 noon/evening 协调棒续立信号的回访。 本稿 GitHub 写入:0(按规则不执行 git commit / git push / gh pr) 建议落点:
/shared/research-kb/inbox/stephen/2026-08-01-2245-stephen-coordination-check-evening.md(最终整合任务再写 review/,本稿先在 inbox 立标)
一、本次主题
跨实例协调复盘(agent / rag / multimodal / engineering / systems / csdn / substack / risk / llm-application / llm-infra 十向覆盖度 + 冲突核对 + 缺口标注 + 编排窗口建议 + 人工确认)
二、检索范围
- 今天 inbox 各实例 evening 产出(stephen / tom / jay / flyp / spark 共 ~35 篇新草稿)
- 12:45 → 22:45 CST 之间晚间高频推送与 evening briefing
- 7-31 evening 协调棒 + 8-1 noon 协调棒(基线参考)
- HF Daily / arXiv / Substack / CSDN / MSR Blog / Sigcomm / Import AI / EuroSys / ICDCS / ICLR / NDSS 公开来源(在前置各实例简报已核过的前提下,不重复检索)
三、十向覆盖度盘点(evening 完整态)
✅ A. Agent(含多智能体、agent memory、agent harness)
- Stephen:llm-application-e1prep(5 重大 + 3 旁证 = 8 件;OpenAI ChatGPT Agent 三层架构 + MSR Echoverse + MirrorCode + FutureAGI 五指标 + Fairness Pruning + BM25/OP-RAG + SymCrypt 形式化验证 + MCP 2.0 stateless + Σ-Mem 第五路 + Lilian Weng 八元组 + Mythos 密码学)
- Tom:agent-rag-longcontext-radar v2/v3(8 候选 4 高价值:Σ-Mem + Filesystem + DualG-MRAG + GLM-RAG)+ inference-e1prep(旁证 MCP 2.0 + Lilian Weng Harness + ByteByteGo Agent Loop = Agentic 推理三层架构收敛)
- Jay:6 篇 evening briefing 串联产出(八元组公式 + ByteByteGo 三层架构 + MirrorCode benchmark + SymCrypt Rust 形式化验证 + MSR Echoverse 合成世界 + 6 维度工具集 = 全员汇聚到 Agentic Engineering §2.7 学科化 + 工程复现 §2.14)
- Flyp:risk-e1prep(R34 立标固化期延续 + Σ-Mem arXiv:2607.27958 trust-modeling-as-attack-surface 三联立 + Filesystem arXiv:2607.26637 filesystem-as-attack-surface 四联立 + MisKnow-Agent deep-research-as-attack-surface 三联立 + 1 项 NDSS P0 警示 Shadow in the Cache arXiv:2508.09442)+ ShadowDancer/CoMem critical-read
- Spark:agent-e1prep-v37(24h 净增量 6 件 P0/P1 立标候选 + 2 件 P1/P2 邻接 + 1 件警示 EU AI Act 8-2 deadline 临门 + 1 件反方 + 1 件状态变化)
- 冲突:无重复(5 实例同步立标饱和:Σ-Mem / Filesystem-Based Memory / DualG-MRAG / GLM-RAG / MisKnow-Agent / ConMem 在 5 实例的 8 草稿中已全覆盖;stephen + jay + tom + flyp + spark 互为对照,未出现新增 arXiv 编号)
- 饱和度:极高
✅ B. RAG
- Stephen:ai-industry-e1prep(BM25 Wins at Scale 38▲ + HF Daily 8-1 票榜 + 主线 7 VLA 飞轮邻居 PhiZero)+ llm-application-e1prep(FutureAGI RAG Reimagined + FutureAGI 五指标)
- Tom:rag-e1prep(R50 收官延续 + R51 启动准备就位)+ 雷达 v2(8 候选 4 高价值)+ evaluation-e1prep(3 增量)
- Jay:1105 briefing(pgvectorscale 471 QPS @ 99% recall 11.4× Qdrant + PostgreSQL CIDR 2026 + LanceDB + 混合检索)+ 1220 csdn-rag-agent-moe(RAG 2026 实战 4 件 = GraphRAG + AgenticRAG + VisionRAG + 五步优化 + 5 大 Agent 框架横评)+ 1505 briefing(KV Cache Transform Coding ICLR 2026 邻接)+ 1950 briefing(KV Cache Transform Coding + Particula-SGLang 29% + RAG 评估工具格局)+ 2105 briefing(RAG 2026 架构格局 Future AGI / Turing Post 20 种 + 六层 pipeline 评估 + 混合检索 + Reranker 当下最优基线)
- Flyp:deep-read + adversarial-review(BM25 / DualG-MRAG / Filesystem 三联立 + 反方元层 6 条证伪线/件 + 哲学综述沿用)
- Spark:未单独做 RAG 一线(让位 tom/jay/flyp)
- 冲突:
- flyp vs tom 对 DualG-MRAG / Filesystem 的视角差:tom 立标(rag 主 multimodal 副),flyp 反方审稿(在"工程经验 vs 学术评测"微妙偏差上)。两者并非冲突,是同件套的双视角。
- FutureAGI RAG Reimagined(stephen llm-application-e1prep 增量 6)vs FutureAGI / Turing Post 20 Advanced RAG Types(jay 2105 briefing C2):两个独立来源(Substack + 综述) 都用 FutureAGI 名义,但 jay 写"Future AGI / Turing Post"为二源,stephen 写"FutureAGI Substack"为单源——同一公司不同发布渠道,无内容冲突,建议在活文档 v42/v43 同步引用。
- 饱和度:高(事件饱和 + 4 实例重叠,应避免新立 RAG 主线;下周再启动增量)
✅ C. Multimodal(vision-language-video)
- Stephen:ai-industry-e1prep(Cosmos-H-Dreams + PhiZero + Gemini Robotics 2 邻接)+ X radar 0910(Mythos HAWK/AES 7-28 + HF 加入 Open Secure AI Alliance 7-27 + Anthropic 3 起事件 7-27 + HF Training Agents 3 7-28 + AMI Labs $1.03B 7 月 + Sam Altman 白宫自愿评估框架 7-29)
- Tom:radar See2Think 邻接 + HF Daily Qwen-UI-Agent 265▲ 票榜立标(GUI 基础 Agent,多模态邻接)
- Jay:engineering-e1prep(MirrorCode 25 目标程序 + Lilian Weng 八元组 + ByteByteGo 三层架构 + MSR SymCrypt + Echoverse)+ 1300 briefing(GoodServe/AMPD/LAAR/AIConfigurator/Workload-Router-Pool/Fluid-Guided 6 件 inference 新论文)
- Flyp:multimodal-e1prep-v35 第一棒(14 件候选增量 = See2Think + ShadowDancer + LEDGERMIND + CoMem + DualG-MRAG + Kimi K3 + X radar 9 件)+ risk-e1prep(Shadow in the Cache arXiv:2508.09442 NDSS 2026 KV-cache 隐私/侧信道 = multimodal 邻接安全)
- Spark:未单独做 multimodal 一线(让位 flyp)
- 冲突点:
- multimodal 活文档 v34 已 96h 未更新,超 3 天红线 24h(flyp multimodal-e1prep v35 第一棒明示)—— 本场 evening 必须启动 v34 → v35 编排窗口(紧迫度:高)
- stephen 8-1 X radar 0910 + flyp multimodal-e1prep 7 件包络确认:双方一致(4 件立标候选 = Mythos Preview + Anthropic 3 起事件 + Sam Altman 白宫自愿评估框架 + HF Training Agents 3),无需协调
- 饱和度:高
✅ D. Systems / Engineering(推理系统 / 工程实践 / 系统化)
- Stephen:ai-industry(HF blog LFM2.5-Encoders CPU 长文本编码器 3.7× ModernBERT + LlamaParse 智能路由)+ llm-application-e1prep(OpenAI ChatGPT Agent 三层架构生产实例 + MSR Echoverse 训练时合成世界 + MirrorCode 超长程评测 + FutureAGI 五指标 + SymCrypt 形式化验证 + MCP 2.0 stateless)
- Tom:inference-e1prep(6 主线 + 2 旁证:GoodServe E2E-SLO goodput + AMPD Multi-round PD 分 离 + LAAR NUMA-aware long-context routing + Token-Operations 四层架构 + Harvest P2P GPU cache 43.48% 利用率 + Agent Memory Edge Q4 KV cache + 旁证 MCP 2.0 + Lilian Weng + ByteByteGo Agent Loop + SuperInfer GH200 + KernelSight-LM)
- Jay:engineering-e1prep-v42 6 增量(ByteByteGo 三层架构 + MirrorCode + Lilian Weng 八元组 + Simon Willison MCP 2.0 + MSR Echoverse + MSR SymCrypt)+ 1105 briefing(5 数据库/后端/云原生复现档)+ 1300 briefing(6 件 inference-systems arXiv 新论文)+ 1505 briefing(MCP 2.0 + KV Cache Transform Coding + DUAL-BLADE + Shadow in the Cache + MirrorCode)+ 1620 csdn-rag-agent-tensorrt-deploy(NVIDIA TensorRT-LLM Qwen3 命令 + PyTorch-CUDA-v2.7 + DeepSeek-R1 + PyTorch Quantization)+ 1735 briefing(vLLM/SGLang/TGI/TRT-LLM H100 benchmark + 2026 模型格局 + HF State of OS Spring 2026 + AI Engineer 1000+ JD + GitHub Top 12)+ 1950 briefing(KV Cache Transform Coding ICLR 2026 + Harvest P2P + Agent Memory Edge Q4 + Particula-SGLang 29%)+ 2105 briefing(Bespoke OLAP ICLR 2026 + GenDB + HotPrefix SIGMOD 2026 + pgvector 0.9 VecDB 2026 + llm-d CNCF Sandbox + Kthena + CXL Memory-Disaggregated HotInfra 2026 + LLM 推理指纹 CVE-2026 + vLLM vs SGLang H100 基准 + Weaviate v1.37 MCP Server)
- Flyp:deep-read + adversarial-review(BM25 / DualG-MRAG / Filesystem 三件的工程经验 vs 学术评测对照 = 6 条证伪线/件)
- Spark:llm-infra-e1prep(5 主线 + 3 旁证 + 2 警示:KV Cache 顶会三件套 ICDCS/ICLR/NDSS + Agentic Serving 三件套 GoodServe/AMPD/Workload-Router-Pool + AIConfigurator + Fluid-Guided + 推理引擎 4 选 1 + MCP 2.0 + MSR Echoverse + MSR SymCrypt)
- 冲突点:
- tom inference-e1prep + spark llm-infra-e1prep + jay 1300/1950 briefing 三实例对 GoodServe/AMPD/LAAR/Token-Operations/Harvest/Agent Memory/Workload-Router-Pool/AIConfigurator/Fluid-Guided 的视角差:
- tom:以"调度 §2.2 / KV cache §2.3"分类立标(inference.md 主线锚点)
- spark:以"KV cache 顶会三件套 + Agentic Serving 立标三件套"分类立标(llm-infra.md §1.(3) + §1.(2) 调度 9 学派邻接)
- jay:以"早间 + 午间 + 傍晚 6 高价值论文"分类立标(engineering.md §2.95 evaluation discipline + §2.7 Agentic Engineering 学科化邻接)
- 三视角互补不冲突:建议在 inference.md / llm-infra.md / engineering.md 三份活文档同步立标,引用同一 arXiv 编号但视角不同
- jay 1105 briefing pgvectorscale 471 QPS @ 99% recall 11.4× Qdrant 数据(Actian Q2 2026 + Firecrawl)与现有 VecDB 选型共识:写入路径正确,但提示读者 pgvectorscale 在
r6id.4xlarge AWS 实例 + Cohere Wikipedia 768 维 50M上才达到此数字,工程落地时不能直接外推到生产(已在 noon 协调棒标注) - jay 2105 briefing Bespoke OLAP ICLR 2026 + CXL Memory-Disaggregated HotInfra 2026 + Weaviate v1.37 MCP Server:3 件大信号——Bespoke OLAP 51× speedup + CXL PIM-DIMM 39.7× cost reduction + Weaviate 原生 MCP Server = 数据库 + 系统 + 向量 DB 三大基础设施跃迁
- 饱和度:极高
✅ E. CSDN(工程实践层 · 严格筛选)
- Jay:今天 8 篇 CSDN 主题稿
- 0821 csdn-substack-weekly(火山引擎 · vLLM 投机解码 · SGLang · 2026 AI 技术路线图)
- 1050 jay-engineering-filter(10 条高价值 = Kimi K3 权重开源 / DeepSeek-V4-Flash / Solar / OpenAI HF 评估安全事件 / Kimi K3 inference 子节 / 边缘部署 8 项)
- 1058 engineering-e1prep-v42 准备棒
- 1220 csdn-rag-agent-moe(RAG 实战 4 篇 + Agent 框架 4 篇 + MoE 3 篇 + LangChain 1 篇 = 12 件)
- 1620 csdn-rag-agent-tensorrt-deploy(NVIDIA TensorRT-LLM Qwen3 部署 + PyTorch-CUDA-v2.7 + DeepSeek-R1 + YOLOv8 DFL + PyTorch Quantization)
- 1240 隐线(增量补充件)
- 1335 jay-arxiv-inference-systems-vecdb-2026(SGLang vs vLLM + Workload-Router-Pool + Fluid-Guided)
- 1735 jay-inference-engines-open-llms-2026(YottaLabs + Spheron + DeployBase 推理引擎横评)
- 其他实例:未单独做 CSDN 一线(让位 jay)
- 饱和度:极高
✅ F. Substack / RSS(高质量评论、行业 newsletter)
- Stephen:X 名人雷达 0910(Sam Altman / Anthropic / DeepMind / HF / Jim Fan / Mollick / Karpathy / Andrew Ng / Yann LeCun 13 件)
- Tom:103 RSS 频道(Lex Fridman + Yannic Kilcher)+ HF Daily 8-1 票榜
- Jay:11 RSS 频道(bytebytego / simon-willison / raschka / nathan-benaich / lilian-weng / cool-papers(-ir/-regular) / msr-blog / import-ai / yt-karpathy / yt-fireship)+ csdn-substack-weekly 0821(含海外 Substack 旁路)
- Flyp:interconnects / cameron-wolfe + deep-read 中 jamwithai 1 条 + rasbt "LLM Research Papers 2026" 1 条 = 3 条 Substack 线索
- Spark:chip-huyen / gradient-flow = 2 条线索(含"AI 可以胜出而数据中心却亏损"批评线索)
- 冲突点:
- flyp rasbt "LLM Research Papers: The 2026 List (January to May)" 7-30 综述与 stephen ai-industry 主线 (174) AI 综述邻接:两者无引用重复,建议在活文档 v34 §6 行业 13 主线里只选一条为主线立标,另一条作"延伸追踪"
- stephen llm-application-e1prep 增量 6 FutureAGI Substack "RAG Reimagined 5 Breakthroughs" 与 jay 2105 briefing C2 Future AGI / Turing Post "20 Advanced RAG Types":同源不同发布渠道,无内容冲突
- Substack 缺口(按 6-10 启用规则):
- r.jina.ai / jlelse substack / Latent Space(swyx)/ The Pragmatic Engineer / benn.substack / Last Week in AI:今天 5 个实例未单独做这一线索汇总 → noon 协调棒已标注"下周一并入"
- jay 2105 briefing C1 The AI Engineer Substack "AI Agents Stack 2026 Edition"(swyx + Alessi) = 本场 evening 新补充 1 条高质量 Substack 线索(八十千订阅),归入本期 Substack 覆盖
- 饱和度:中高(缺口见上 + evening 已补 swyx 1 条)
✅ G. 工程复现 / 排障(高价值 CSDN 子集)
- Jay:1105 briefing(5 条复现档 · pgvector + PostgreSQL + LanceDB + Kimi K3 + DeepSeek-V4 工程化)+ 0821 csdn-substack-weekly(vLLM 投机解码源码解析 · LangChain OpenDeepResearch 本地部署)+ 1620 csdn-rag-agent-tensorrt-deploy(NVIDIA TensorRT-LLM 完整命令栈)+ 2105 briefing R1 Bespoke OLAP 开源实现可直接复现
- 其他实例:未单独做
- 饱和度:高(事件饱和)
✅ H. Risk / Security(新增 evening 向)
- Flyp:risk-e1prep R34 立标固化延续(7 条 net-new 增量 = 1 项 NDSS P0 警示 Shadow in the Cache + 2 P1 Σ-Mem + Filesystem trust-modeling-as-attack-surface 三联立 + filesystem-as-attack-surface 四联立 + 1 P1 MisKnow-Agent deep-research-as-attack-surface 三联立 + 1 P0 EU AI Act 8-2 24h 临门 + 2 P2/P3 OpenAI/HF + 1 强提醒 Sam Altman + 1 元方法学 MSR SymCrypt = 38 件 arXiv + 8 条待核实说法 + R34 已固化立标的持续续立信号表)
- Stephen:ai-industry-e1prep 增量 2(EU AI Act 8-2 deadline 临门)+ 增量 5(Sam Altman 华盛顿政策窗口 + 白宫自愿评估框架)+ 增量 7(OpenAI HF 模型评估安全事件 + 8-1 捣毁柬埔寨诈骗犯罪团伙 = frontier lab × 安全工程 第 7/8 例)+ 增量 8(HF 加入 Open Secure AI Alliance = 第 4 立家)
- Jay:1505 briefing D3 Shadow in the Cache NDSS 2026 KV-cache 隐私/侧信道;1735 briefing D2 AI Engineer 1000+ JD 含 frontier lab × 安全工程邻接
- Spark:agent-e1prep-v37 增量 5 MisKnow-Agent deep-research-as-attack-surface 三联立 + §增量 7 OpenAI 捣毁诈骗犯罪 + Open Secure AI Alliance
- 冲突:
- flyp risk-e1prep 与 stephen ai-industry-e1prep 对 EU AI Act 8-2 临门态势:stephen 视角为 8-1 上午(增量 2 §),flyp 视角为 8-1 下午(增量 5 §);差 ~6h,建议沿用 stephen 时间口径("deadline 倒计时 36h → 0h · 8-1 上午"),footnote 给 flyp 8-1 下午时间口径
- flyp risk-e1prep 与 jay 1505 briefing D3 对 Shadow in the Cache 立标位:flyp 立"§2.1 ⑥ L0' 元层+dev 风险类目 第 2 例 + KV-cache 侧信道";jay 标注"Engineering 复现必备"。两者互补不冲突
- flyp risk-e1prep 与 spark agent-e1prep-v37 对 Σ-Mem trust-modeling-as-attack-surface 三联立:flyp 立"R34 §2.1 C 类立标候选 第 3 拍 + 信任建模侧分支";spark 立"Σ-Mem vs Metis 内化原生 vs 外化可信两条腿"。两者互补
- 饱和度:高
✅ I. LLM Application / Harness Engineering(新增 evening 向)
- Stephen:llm-application-e1prep(5 重大 + 3 旁证 = 8 件净增量 + 15 件已立 v42 激活 + 13 件非论文来源 = 36 件涉及项;OpenAI ChatGPT Agent 三层架构 + MSR Echoverse + MirrorCode + FutureAGI 五指标 + Fairness Pruning + BM25/OP-RAG + SymCrypt 形式化验证 + MCP 2.0 stateless + Σ-Mem 第五路 Memory + Lilian Weng 八元组 + Mythos 密码学)
- Tom:inference-e1prep 旁证 1(MCP 2.0 + Lilian Weng Harness + ByteByteGo OpenAI Agent Loop = Agentic 推理三层架构收敛)
- Jay:engineering-e1prep 增量 1-6(ByteByteGo 三层架构 + MirrorCode + Lilian Weng 八元组 + Simon Willison MCP 2.0 + MSR Echoverse + MSR SymCrypt)
- Flyp:未单独做 LLM Application 一线(让位 stephen)
- Spark:未单独做 LLM Application 一线(让位 stephen)
- 冲突:
- stephen llm-application-e1prep + jay engineering-e1prep 6 增量完全重合:stephen 主线锚点(llm-application.md v42 → v43)+ jay 工程化(engineering.md v41 → v42)双活文档同步升级
- Lilian Weng 八元组公式 vs ByteByteGo 三层架构:stephen 整合两者为"v43 §1.1 整合时需说'两层抽象同时存在'";jay 未明确整合两者,建议在 engineering.md v42 §2.7 也添加 footnote
- 饱和度:极高(事件饱和)
✅ J. LLM Infra / Inference Systems(新增 evening 向)
- Tom:inference-e1prep(6 主线 + 2 旁证 + 1 警示 = 8 件净增量 + 38 件 arXiv 编号)
- Spark:llm-infra-e1prep(5 主线 + 3 旁证 + 2 警示 = 7 主线 + 3 旁证 + 2 警示;KV Cache 顶会三件套 + Agentic Serving 三件套 + AIConfigurator + Fluid-Guided + 推理引擎 4 选 1 + MCP 2.0 + MSR Echoverse + MSR SymCrypt)
- Jay:1300 briefing 6 件 inference 新论文 + 1735 briefing 4 件推理引擎横评 + 1950 briefing KV cache + 2105 briefing llm-d CNCF + Kthena + CXL Memory-Disaggregated + HotPrefix SIGMOD 2026 + vLLM/SGLang CVE-2026
- Stephen:未单独做 llm-infra 一线(让位 tom/spark)
- Flyp:未单独做 llm-infra 一线(让位 tom/spark)
- 冲突:
- tom inference-e1prep + spark llm-infra-e1prep 对 GoodServe/AMPD/LAAR/Harvest/Agent Memory/Token-Operations 立标位的视角差:tom 立 inference.md,spark 立 llm-infra.md,两份活文档同步升级,引用同一 arXiv 编号
- tom inference-e1prep 与 stephen llm-application-e1prep 对 Agentic 推理三层架构收敛(MCP 2.0 + Lilian Weng + ByteByteGo):tom 在 §7 Agent 生产推理邻接;stephen 在 §1.1 应用架构 + §5 工程落地框架 #3 状态分层。两者互补,建议双活文档同步升级
- spark llm-infra-e1prep 警示 "tom 7-31 inference E1 已恢复但 8-1 仅 6 件常规通稿 0 件 inference-e1prep · spark 8-1 morning 第 8 棒独立 E1 仍缺":傍晚已修正——tom 8-1 22:24 inference-e1prep 已写入;spark llm-infra-e1prep-v13 已写入。无冲突
- 饱和度:极高
四、跨实例冲突 / 重复 / 缺口 三向核对(evening 完整态)
1. 重大重复(需要合并或分流)
| 件 | 触及实例 | 重复性质 | 建议处置 |
|---|---|---|---|
| Σ-Mem (arXiv:2607.27958) | stephen(ai-industry+llm-application) + tom(radar+RAG e1prep) + jay(no) + flyp(deep-read+adversarial+critical-read+risk-e1prep) + spark(agent-e1prep) + paper_cards/683 | 6 实例 6 文件同源立标饱和 | flyp risk-e1prep 立"R34 §2.1 C 类立标候选 第 3 拍 + trust-modeling-as-attack-surface 三联立首例";stephen llm-application 立"§1.3 Memory 第五路候选";tom radar + rag-e1prep 立"R51 §2.17 K 候选";spark agent-e1prep 立"v37 §2.2 第六十二节点";统一编号 Σ-Mem = arXiv:2607.27958,各活文档独立引用,不重写 |
| Filesystem-Based Memory (arXiv:2607.26637) | stephen(ai-industry+noon+llm-application 旁证 B 邻接) + tom(radar+RAG e1prep) + jay(no+ lilian-weng RSS Pattern 2) + flyp(deep-read+adversarial 论文 C+critical-read+multimodal-e1prep+risk-e1prep) + spark(agent-e1prep) + paper_cards/686 | 6 实例 6 文件同源立标饱和 | flyp risk-e1prep 立"filesystem-as-attack-surface 四联立";stephen noon 立"§2.17 J 候选";tom radar + rag-e1prep 立"R51 §2.17 J";spark agent-e1prep 立"v37 §2.2 候选新增 L 雏形";统一编号,各活文档独立引用 |
| DualG-MRAG (arXiv:2607.28580) | stephen(ai-industry 邻接) + tom(radar+RAG e1prep) + jay(c1260/last) + flyp(deep-read+adversarial+multimodal-e1prep) + spark(agent-e1prep) + paper_cards/674 | 5 实例同源 + 1 隐含 | 立标统一归 tom R51 §2 主线 + flyp 反方 + multimodal §1.3 综述邻接 + spark agent §2.2 候选 + stephen ai-industry 邻接 + jay csdn 邻接 |
| GLM-RAG (arXiv:2607.28397) | stephen(no) + tom(radar+RAG e1prep) + jay(c1220) + flyp(no) + spark(agent-e1prep) + paper_cards/675 | 4 实例同源 | 沿用 rag.md R51 §2 候选 |
| MisKnow-Agent (arXiv:2607.20891) | stephen(noon) + tom(radar v2) + jay(c1220) + flyp(risk-e1prep 增量 4) + spark(agent-e1prep 增量 5) + paper_cards/687 | 5 实例同源 | flyp risk-e1prep 立"deep-research-as-attack-surface 三联立 L2 接口层 第 1 例" |
| ConMem (arXiv:2607.28126) | stephen(ai-industry 邻接) + tom(radar+RAG e1prep) + jay(no) + flyp(no) + spark(agent-e1prep) + paper_cards/676 | 4 实例同源 | rag.md R51 §2.17 候选 L + agent.md §2.2 邻接 + risk.md §2.1 C 类立标候选 P2 沿用 |
| CoMem (arXiv:2607.28263) | stephen(llm-application 邻接) + tom(no) + jay(no) + flyp(multimodal-e1prep 增量 4+critical-read) + spark(agent-e1prep 邻接) + paper_cards/678 | 4 实例同源 | multimodal.md v35 §1.2 长上下文 / 长记忆邻接 + agent.md §2.2 邻接 |
| ShadowDancer (arXiv:2607.28362) | stephen(no) + tom(no) + jay(no) + flyp(multimodal-e1prep 增量 2+critical-read 1550) + spark(no) + paper_cards/682 | 2 实例同源 + 2 paper_cards | multimodal.md v35 §2.39.x 候补级 |
| LEDGERMIND (arXiv:2607.28374) | stephen(llm-application 邻接) + tom(no) + jay(no) + flyp(multimodal-e1prep 增量 3) + spark(no) + paper_cards/680 | 2 实例同源 | multimodal.md v35 §2.39.x 候补级 + llm-application.md §1.4 评测与可靠性邻接 |
| See2Think (arXiv:2607.26769) | stephen(llm-application 旁证) + tom(radar) + jay(no) + flyp(multimodal-e1prep 增量 1+critical-read 1550) + spark(no) + paper_cards/685 | 3 实例同源 | multimodal.md v35 §1 主线 4 评测方法学新增 + llm-application.md §1.4 评测与可靠性 + rag.md 评测方法邻接 |
| Fairness Pruning (arXiv:2607.28319) | stephen(llm-application 增量 5) + tom(evaluation-e1prep 增量 1+ radar) + jay(no) + flyp(risk-e1prep 邻接) + spark(agent-e1prep) + paper_cards/684 | 4 实例同源 | evaluation.md R33 §1.4 评测与可靠性 + llm-application.md §1.4 + risk.md §2.6 沿用 |
| Kimi K3 2.8T (BenchLM #2/32 89.6/100) | stephen(ai-industry) + jay(engineering-filter+0935) + flyp(multimodal-e1prep 增量 6) | 3 实例覆盖但视角不同 | multimodal.md v35 §6 行业 8 主线 + engineering.md v42 §6 行业延伸 + ai-industry.md v34 §6 行业 17 足候选 |
| MirrorCode benchmark (METR/Epoch AI 8-1) | stephen(llm-application 增量 3) + jay(engineering-e1prep 增量 2+1505 briefing R1) + flyp(no) + spark(no) | 3 实例覆盖 | engineering.md v42 §2.8 + llm-application.md v43 §1.1 Coding Agent 评测 |
| MSR Echoverse (训练 Computer-Use Agent 合成世界) | stephen(llm-application 增量 2) + jay(engineering-e1prep 增量 5) + spark(llm-infra-e1prep) | 3 实例覆盖 | llm-application.md v43 §1.1 + engineering.md v42 §2.14 |
| MSR SymCrypt Rust+Lean+Aeneas 形式化验证 | stephen(llm-application 增量 7) + jay(engineering-e1prep 增量 6) + spark(llm-infra-e1prep 邻接) + flyp(risk-e1prep 增量 7) | 4 实例覆盖 | llm-application.md v43 §1.4 + engineering.md v42 §2.15 + risk.md §2.6 frontier lab × 安全工程 第 6 例 + llm-infra.md §1.(10) 沿用 |
| Lilian Weng Harness Engineering 八元组公式 | stephen(llm-application 旁证 B) + jay(engineering-e1prep 增量 3) + tom(inference-e1prep 旁证 1) | 3 实例覆盖 | llm-application.md v43 §1.1 + engineering.md v42 §2.7 + inference.md §7 |
| ByteByteGo OpenAI ChatGPT Agent 三层架构 | stephen(llm-application 增量 1) + jay(engineering-e1prep 增量 1) + tom(inference-e1prep 旁证 1) | 3 实例覆盖 | llm-application.md v43 §1.1 + engineering.md v42 §2.7 + inference.md §7 |
| MCP 2.0 stateless 协议(Simon Willison + 官方 7-28) | stephen(llm-application 增量 8) + jay(engineering-e1prep 增量 4) + tom(inference-e1prep 旁证 1) + spark(llm-infra-e1prep 旁证) | 4 实例覆盖 | llm-application.md v43 §1.1 + engineering.md v42 §2.7 + inference.md §7 + llm-infra.md §1.(4) |
| FutureAGI RAG 五指标 + RAG Reimagined | stephen(llm-application 增量 4+6) + jay(2105 briefing C2) + tom(evaluation-e1prep 增量 3) | 3 实例覆盖 | llm-application.md v43 §1.2 + rag.md R51 §2 + evaluation.md R33 §1.4 |
| OpenAI 8-1「推进欧洲负责任 AI」 + EU AI Act 8-2 临门 | stephen(ai-industry 增量 2) + flyp(risk-e1prep 增量 5) + spark(agent-e1prep 警示) | 3 实例覆盖 | ai-industry.md v34 §1.3 frontier lab × 治理 + risk.md §2.1 ⑧ 24h 临门 + agent.md §3.2 警示沿用 |
| Shadow in the Cache NDSS 2026 (arXiv:2508.09442) | flyp(risk-e1prep 增量 1) + spark(llm-infra-e1prep 增量 1 D3) + jay(1505 briefing D3) + tom(inference-e1prep 横向参照) | 4 实例覆盖 | risk.md §2.1 L0' 元层+dev 风险类目 第 2 例 + llm-infra.md §1.(3) KV cache 14+1 件套新增 DUAL-BLADE/Transform Coding/Shadow in the Cache 作为「七大顶会议 KV-cache 集中爆发立标」+ inference.md §2.3 横向参照 |
| KV Cache 顶会三件套 (DUAL-BLADE ICDCS 2026 + KV Cache Transform Coding ICLR 2026 + Shadow in the Cache NDSS 2026) | spark(llm-infra-e1prep 增量 1) + jay(1505 briefing D1/D2/D3+1950 briefing E1) + tom(inference-e1prep 横向参照) + flyp(risk-e1prep 增量 1) | 4 实例覆盖 | llm-infra.md §1.(3) 七大顶会议 KV-cache 集中爆发立标 + risk.md §2.1 邻接 + inference.md §2.3 邻接 |
| Agentic Serving 调度立标三件套 (GoodServe + AMPD + Workload-Router-Pool) | tom(inference-e1prep 增量 1+2) + spark(llm-infra-e1prep 增量 2) + jay(1300 briefing A1/A2/A5) | 3 实例覆盖 | inference.md §2.2 调度 + llm-infra.md §1.(2) 调度 9 学派邻接 + engineering.md §2.95 evaluation discipline 邻接 |
| OpenAI 8-1 捣毁柬埔寨诈骗犯罪团伙 + HF 加入 Open Secure AI Alliance | stephen(ai-industry 增量 7+8) + flyp(risk-e1prep 增量 6) + spark(agent-e1prep 增量 7) | 3 实例覆盖 | ai-industry.md v34 §1.3 + risk.md §2.1 ④ 第 6/7 例 + agent.md §2.2 frontier lab × 安全工程 第 6/7 例 |
| BM25 Wins at Scale (arXiv:2607.26497) | stephen(ai-industry 增量 3+ llm-application 增量 6) + tom(radar+RAG e1prep) + flyp(deep-read+adversarial) + spark(agent-e1prep §5 边界) + jay(no 显式) | 4 实例 + 1 隐含覆盖 | rag.md R51 §2.16 RAG 范式规模化对照基线 + ai-industry.md v34 §6 行业 17 足 8-1 补立 + llm-application.md v43 §1.2 |
2. 缺口(需要人工确认或后续补位)
| 缺口 | 影响面 | 优先级 | 建议动作 |
|---|---|---|---|
| Substack 周度汇总未做(r.jina.ai / jlelse substack / Latent Space / Last Week in AI 等完整覆盖) | 评论层与海外 newsletter 覆盖 | 中 | Jay 2105 已补 swyx 1 条;剩余建议下周一并入 |
| multimodal 活文档 v34 已 96h 未更新,超 3 天红线 24h | multimodal 主线活文档滞后 | 极高 | 今晚必须启动 v34 → v35 编排窗口(flyp multimodal-e1prep-v35 第一棒已就位 14 件候选增量) |
| agent 活文档 v37 已就位待编排(spark 8-1 13:30 agent-e1prep 已就位 24h 净增量 6 P0/P1 + 2 P1/P2 + 1 警示 + 1 反方 + 1 状态变化) | agent 主线锚点 | 高 | 今晚或明天由 spark 启动 v37 编排 |
| RAG 主线活文档 R50 → R51 待编排(tom 8-1 08:50 rag-e1prep 已就位 R51 3 增量 + 5 件候选) | RAG 主线锚点 | 中 | 今晚或明天由 tom 启动 |
| inference 主线活文档待编排(tom 8-1 22:24 inference-e1prep 已就位 6 主线 + 2 旁证 + 1 警示 = 8 件净增量 + 38 件 arXiv 编号) | inference 主线锚点 | 高 | 今晚由 tom 启动 inference.md 编排窗口 |
| llm-infra 主线活文档待编排(spark 8-1 18:47 llm-infra-e1prep-v13 已就位 5 主线 + 3 旁证 + 2 警示 + §IX 关键拐点 12 件) | llm-infra 主线锚点 | 高 | 今晚由 spark 启动 llm-infra.md 编排窗口(§IX 已 34th 抢修完成版,可直接增量吸收) |
| risk 主线活文档 R34 → R35 待编排(flyp 8-1 risk-e1prep 已就位 R34 立标固化延续 + 7 条 net-new 增量 + 1 强提醒 + 1 元方法学) | risk 主线锚点 | 中 | 今晚或明天由 flyp 启动 |
| llm-application 主线活文档 v42 → v43 待编排(stephen 8-1 21:10 llm-application-e1prep 已就位 8 件净增量 = 5 重大 + 3 旁证) | llm-application 主线锚点 | 高 | 今晚由 stephen 启动 llm-application.md 编排窗口 |
| engineering 主线活文档 v41 → v42 待编排(jay 8-1 11:20 engineering-e1prep 已就位 6 增量 + 1105 briefing 5 件 + 1300 briefing 6 件 + 1505 briefing 5 件 + 1735 briefing 4 件 + 2105 briefing 10 件 = ~30 件净增量) | engineering 主线锚点 | 高 | 今晚由 jay 启动 engineering.md 编排窗口 |
| ai-industry 主线活文档 v33 → v34 待编排(stephen 8-1 10:21 ai-industry-e1prep 已就位 8 增量 + 12 件 paper_cards 待建卡) | ai-industry 主线锚点 | 高 | 今晚由 stephen 启动 |
| HF Daily 8-1 票榜 15 件中 12 件 paper_cards 未建卡(AskChem / Qwen-UI-Agent / PhiZero / Frontis-MA1 / DistillAlign / VideoCoCo / Memory Decoder at Scale / Beacon / BM25 Wins at Scale / Flux-OPD / MPIE-Bench / ACE-Data-0 / Beyond Borrowed Histories) | 候选池卡片缺失 | 高 | 今晚 v34 启动前先建卡(特别是 PhiZero + Frontis-MA1 + Memory Decoder at Scale 三大立标候选) |
| jay 1105 briefing pgvectorscale 471 QPS 数据需在 jay 文中已显式警示("AWS r6id.4xlarge + Cohere Wikipedia 768 维 50M"特定环境不可外推) | VecDB 选型共识落地 | 低 | 已显式说明,无需额外动作 |
| Spark dual-rss/chip-huyen "构建生成式 AI 平台的常见组件" / 构建生成式 AI 应用陷阱 | 平台化层 | 低 | spark 已隐含在 chip-huyen 1002 RSS 通稿,无需升级 |
3. 潜在冲突(需要人工确认)
| 冲突 | 双方表述 | 建议处置 |
|---|---|---|
| Σ-Mem 与 Filesystem-Based Memory 在 RAG §2.17 Memory 架构候选位的归类 | tom 已映射到 §2.17 J/Filesystem 已立;Σ-Mem 提议"记忆建模可信赖性路径"作为候选 K;flyp 未在文件系统对立位立标;stephen llm-application 立"第五路信誉记忆 vs 文件 vs 时态图 vs 原生";spark agent-e1prep 立"内化原生 vs 外化可信两套内化路径双立标" | 4 视角统一:J = Filesystem;K = Σ-Mem 信任建模;flyp 文件系统 + 信任建模对立位;stephen llm-application §1.3 Memory 第五路候选;保留到 R51/v43/v37 决策 |
| dualG-MRAG 主页归类(rag 主 vs multimodal 主) | tom = rag 主 multimodal 副;flyp = rag 主 multimodal 副(与 tom 一致);jay csdn 也按 rag/agent 邻接;stephen ai-industry 邻接;spark agent 邻接 | 6 视角无冲突,统一 rag 主 multimodal 副 |
| Kimi K3 主线锚点的版本(K3 vs K2.6) | stephen ai-industry = K2.5 → K3;jay engineering-filter = K2.5 → K3 跃迁;flyp multimodal = K3 2.8T | 5 视角一致,三向 |
| OpenAI GPT-5.6 系列版本号与档位(Sol/Terra/Luna + Codex 档) | stephen 1002 news-openai-news 与 sam Altman 周一 X 已对齐;stephen 0910 X radar 也已对齐 | 无冲突 |
| EU AI Act 2026-08-02 deadline 临门态势 | stephen ai-industry Δ2("OpenAI 8-1 主动提前 24 小时完成治理公开表态")与 flyp risk-e1prep("EU AI Act 2026-08-02 倒计时 24h 临门 + OpenAI 主动提前 24h 完成治理公开表态 + Anthropic Glasswing 续接") | 不冲突但时间窗口需对齐:stephen 视角为 8-1 上午(deadline 倒计时 36h → 0h),flyp 视角为 8-1 下午(deadline 倒计时 24h → 0h)。建议在 ai-industry.md v34 §1.3 沿用 stephen 时间口径("deadline 倒计时 36h → 0h · 8-1 上午"),footnote 给 flyp 8-1 下午时间口径 |
| GoodServe / AMPD / LAAR / Harvest / Agent Memory / Token-Operations / Workload-Router-Pool / AIConfigurator / Fluid-Guided 在 inference.md vs llm-infra.md 的归类 | tom 立 inference.md 主线;spark 立 llm-infra.md 主线;jay 立 engineering.md 主线;stephen llm-application 旁证 1 Agentic 推理三层架构收敛 | 三视角互补不冲突:建议 inference.md / llm-infra.md / engineering.md 三份活文档同步立标,引用同一 arXiv 编号但视角不同 |
| KV Cache 顶会三件套 (DUAL-BLADE ICDCS 2026 + KV Cache Transform Coding ICLR 2026 + Shadow in the Cache NDSS 2026) 在 llm-infra.md §1.(3) vs risk.md §2.1 的归类 | spark 立 llm-infra.md §1.(3) KV cache 14+1 件套新增 + §1.(10) 七大顶会议立标;flyp 立 risk.md §2.1 L0' 元层+dev 风险类目 第 2 例;jay 立 engineering.md 工程复现必备;tom 立 inference.md §2.3 横向参照 | 四视角互补不冲突:建议 llm-infra.md / risk.md / engineering.md / inference.md 四份活文档同步立标 |
| Σ-Mem trust-modeling-as-attack-surface 三联立与 Filesystem-Based Memory filesystem-as-attack-surface 四联立同时存在 | flyp 立"§2.1 C 类立标候选 第 3 拍 + 信任建模 + filesystem 侧分支";spark 立"§2.6 第四十二 f Cyber-Capable + 第四十六 StealthBench + Σ-Mem + Filesystem 形成三联立/四联立" | 不冲突(flyp 视角为 risk.md 主线,spark 视角为 agent.md 主线),建议双活文档同步立标 |
| MirrorCode "bootstrapping 工业文明"判断(Jack Clark Import AI) | stephen llm-application 增量 3 反方警示 3:作为"专家观点 vs 研究结论"对位;jay engineering-e1prep 警示 4:作为引用观点而非定论处理 | 2 视角一致,建议在 engineering.md v42 / llm-application.md v43 同步标注"专家观点 vs 研究结论"对位 |
| Lilian Weng "RSI 路径判断"个人观点属性 | stephen llm-application 旁证 B 反方警示:v43 §5.3 趋势判断"可能在 2027 成为主线"应在 RSI 部分标注该判断为个人观点;jay engineering-e1prep 警示 3:作为工程观点而非工程事实 | 2 视角一致,建议在 engineering.md v42 §2.7 / llm-application.md v43 §5.3 同步标注"个人观点" |
五、高价值条目候选(按跨实例共识度从高到低,含建议写入路径)
Tier A · 5★ 跨多实例共识度(evening 新增 + 升级)
A1. evening 新增强共识条目
-
Σ-Mem (arXiv:2607.27958 · 21▲) — 6 实例 6 文件同源立标饱和(stephen + tom + jay + flyp + spark + paper_cards/683);建议同时入
knowledge/rag.md R51 §2.17 K 候选立标+knowledge/agent.md v37 §2.2 第六十二节点候选+knowledge/llm-application.md v43 §1.3 Memory 第五路候选+knowledge/risk.md §2.1 C 类立标候选 第 3 拍 + trust-modeling-as-attack-surface 三联立首例+knowledge/ai-industry.md v34 §2 frontier lab 立基础邻接 -
Filesystem-Based Memory (arXiv:2607.26637 · 21▲) — 6 实例同源立标饱和;建议
knowledge/rag.md R51 §2.17 J 候选立标+knowledge/agent.md v37 §2.2 候选新增 L 雏形+knowledge/risk.md §2.1 C 类立标候选 第 3 拍 + filesystem-as-attack-surface 四联立+knowledge/llm-application.md v43 §1.3 文件系统记忆沿用 -
DualG-MRAG (arXiv:2607.28580 · ACM MM 2026) — 5 实例同源 + 1 隐含;建议
knowledge/rag.md R51 §2 主线+knowledge/multimodal.md v35 §2.39.x 综述邻接+knowledge/agent.md v37 §2.2 邻接+knowledge/llm-application.md v43 §1.2 RAG 工业补全+knowledge/ai-industry.md v34 §2.137 邻接 -
GLM-RAG (arXiv:2607.28397) — 4 实例同源;建议
knowledge/rag.md R51 §2 候选+knowledge/agent.md v37 §2.2 邻接 -
MisKnow-Agent (arXiv:2607.20891) — 5 实例同源;建议
knowledge/risk.md §2.1 L2 接口层风险类目 第 1 例 + deep-research-as-attack-surface 三联立+knowledge/agent.md v37 §1.4 评测与可靠性邻接+knowledge/llm-application.md v43 §1.4 评测与可靠性沿用 -
CoMem (arXiv:2607.28263) — 4 实例同源;建议
knowledge/multimodal.md v35 §1.2 长上下文 / 长记忆邻接+knowledge/agent.md v37 §2.2 邻接+knowledge/rag.md R51 §2.17 候选 L -
ConMem (arXiv:2607.28126) — 4 实例同源;建议
knowledge/rag.md R51 §2.17 候选 L+knowledge/agent.md §2.2 邻接+knowledge/risk.md §2.1 C 类立标候选 P2 沿用 -
ShadowDancer (arXiv:2607.28362) — 2 实例同源;建议
knowledge/multimodal.md v35 §2.39.x 候补级+knowledge/agent.md §1 主线 7 VLA 邻接 -
LEDGERMIND (arXiv:2607.28374) — 2 实例同源;建议
knowledge/multimodal.md v35 §2.39.x 候补级+knowledge/llm-application.md v43 §1.4 评测与可靠性邻接+knowledge/risk.md §2.13 MCP 安全危机 邻接 -
See2Think (arXiv:2607.26769 · 21▲) — 3 实例同源;建议
knowledge/multimodal.md v35 §1 主线 4 评测方法学新增+knowledge/llm-application.md v43 §1.4 评测与可靠性+knowledge/rag.md R51 §2 评测方法邻接 -
Fairness Pruning (arXiv:2607.28319) — 4 实例同源;建议
knowledge/evaluation.md R33 §1.4 评测与可靠性+knowledge/llm-application.md v43 §1.4+knowledge/risk.md §2.6 沿用+knowledge/agent.md v37 §1.4 邻接 -
Shadow in the Cache (arXiv:2508.09442 · NDSS 2026) — 4 实例同源;建议
knowledge/risk.md §2.1 L0' 元层+dev 风险类目 第 2 例+knowledge/llm-infra.md §1.(3) KV cache 14+1 件套新增+knowledge/llm-infra.md §1.(4) Fail-Plausible 五类 + memory-as-attack-surface 第四立标+knowledge/inference.md §2.3 横向参照 -
MSR SymCrypt Rust+Lean+Aeneas 形式化验证(生产密码学代码) — 4 实例同源;建议
knowledge/llm-application.md v43 §1.4 + §3.1 共识 #2 实现层分解 + §5 #9 安全与隐私+knowledge/engineering.md v42 §2.15 推理工程安全+knowledge/risk.md §2.6 frontier lab × 安全工程 第 6 例 元方法学跟进+knowledge/llm-infra.md §1.(10) 沿用 -
MSR Echoverse 训练 Computer-Use Agent 合成世界 — 3 实例同源;建议
knowledge/llm-application.md v43 §1.1 训练时合成世界层+knowledge/engineering.md v42 §2.14 ICLR 2026 MemAgents Workshop+knowledge/llm-infra.md §1.(10) 沿用 -
Lilian Weng Harness Engineering 八元组公式 + 三 design patterns — 3 实例同源;建议
knowledge/llm-application.md v43 §1.1 + §5 10 项 vs Harness 八元组对照映射+knowledge/engineering.md v42 §2.7 Agentic Engineering 学科化(理论锚点文章)+knowledge/inference.md §7 -
ByteByteGo OpenAI ChatGPT Agent 三层架构 — 3 实例同源;建议
knowledge/llm-application.md v43 §1.1 应用架构 + §0 共识层 + §1.4 + §5 #2 #10+knowledge/engineering.md v42 §2.7 生产实例+knowledge/inference.md §7 -
MCP 2.0 stateless 协议 — 4 实例同源;建议
knowledge/llm-application.md v43 §1.1 工具与协议 + §5 #3 状态分层+knowledge/engineering.md v42 §2.7+knowledge/inference.md §7+knowledge/llm-infra.md §1.(4) -
MirrorCode Benchmark(METR/Epoch AI 8-1)= 超长程编程任务(数周级)可复现评测 — 3 实例同源;建议
knowledge/engineering.md v42 §2.8 VLDB 2026 Demos + SoK Agentic RAG+knowledge/llm-application.md v43 §1.1 Coding Agent 评测第三档 + §1.4 + §5 #7 + §3.2 争议 -
FutureAGI LLM Evaluation Tools Guide 2026 = RAG 评测五指标体系 — 3 实例同源;建议
knowledge/llm-application.md v43 §1.2 RAG 工业指标对照 + §1.4 + §5 #5 + §3.1 共识 #5+knowledge/rag.md R51 §2+knowledge/evaluation.md R33 §1.4 -
BM25 Wins at Scale (arXiv:2607.26497 · HF Daily 8-1 #11 38▲) + FutureAGI RAG Reimagined — 4 实例 + 1 隐含覆盖;建议
knowledge/rag.md R51 §2.16 RAG 范式规模化对照基线+knowledge/ai-industry.md v34 §6 行业 17 足 8-1 补立+knowledge/multimodal.md v35 §1.3 邻接+knowledge/llm-application.md v43 §1.2 + §3.2 争议 #2
A2. evening 新增 inference 系统论文立标(tom inference-e1prep 6 主线)
-
GoodServe arXiv:2605.16867 = Agentic LLM 推理的 E2E-SLO Goodput 调度 — 3 实例同源(tom + spark + jay);建议
knowledge/inference.md §2.2 调度 + §7 Agent 生产推理+knowledge/llm-infra.md §1.(2) 调度 9 学派邻接+knowledge/engineering.md §2.95 evaluation discipline 邻接 -
AMPD arXiv:2602.14516v2 = Multi-round Disaggregated LLM Serving(ReAct Agent 场景专项) — 3 实例同源;建议
knowledge/inference.md §2.2 调度 Disagg 5 节点扩展+knowledge/llm-infra.md §1.(2) 邻接+knowledge/engineering.md §2.13 选型决策树 -
LAAR arXiv:2604.15732v1 = Long-Context-Aware NUMA-Aware 分布式 LLM 路由(GH200 实测) — 2 实例同源(tom + jay engineering-filter);建议
knowledge/inference.md §2.2 调度 + §2.10 系统栈+knowledge/llm-infra.md §1.(2) 邻接 -
Token-Operations Oriented Inference Optimization arXiv:2606.20295v1 四层架构(含 P-EAGLE/MeanCache/Cortex/140T tokens/day 中国数据) — 1 实例单源(tom inference-e1prep + jay 1950 briefing 邻接);建议
knowledge/inference.md §2.5 或新增 §2.11 推理优化全景图节 -
Harvest arXiv:2602.00328v1 = P2P GPU Cache 共享(生产集群 GPU 利用率 43.48% 实证) — 2 实例同源(tom + jay 1950 briefing);建议
knowledge/inference.md §2.3 KV cache 14 件套新增+knowledge/llm-infra.md §1.(3) KV cache 14+1 件套新增 -
Agent Memory arXiv:2603.04428v1 = Edge 设备 Q4 KV Cache 持久化(15.7s / 78.5s dead time 实测) — 2 实例同源(tom + jay 1950 briefing);建议
knowledge/inference.md §2.3 KV cache + §7 Agent 生产推理+knowledge/llm-infra.md §1.(3) 邻接
A3. evening 新增 frontier lab × 治理 / 安全 / 综述 / 行业延伸
-
OpenAI 8-1「Advancing Responsible AI Across Europe」+ Anthropic 8-1 Project Glasswing + EU AI Act 8-2 24h 临门 — 3 实例同源(stephen + flyp + spark);建议
knowledge/ai-industry.md v34 §1.3 frontier lab × 治理 EU AI Act 8-2 deadline 临门联动手独立小节+knowledge/risk.md §2.1 ⑧ P0 监管 24h 临门 + frontier lab × 监管治理 × 国际协作 三栖对位 8-1/8-2 联动 第 1 例+knowledge/agent.md v37 §3.2 警示沿用 -
OpenAI 8-1 捣毁柬埔寨诈骗犯罪团伙 + OpenAI HF 模型评估安全事件 + HF 加入 Open Secure AI Alliance + Anthropic 8-1 YT Project Glasswing + MSR SymCrypt 形式化验证 — 5 视角合流(stephen + flyp + spark + tom inference 邻接 + jay engineering 邻接);建议
knowledge/ai-industry.md v34 §1.3 + §2.114.x + §2 frontier lab × 安全工程 第 4-6 立家+knowledge/risk.md §2.1 ④ 第 6/7/8 例 + §2.6 frontier lab × 安全工程 第 6 例 元方法学跟进 -
OpenAI ChatGPT Agent 三层架构(ByteByteGo 8-1 访谈)= Harness/API/Inference 三层职责分离的具体技术实现 — 3 实例同源;建议
knowledge/llm-application.md v43 §1.1 + §0 共识层 + §1.4 + §5 #2 #10 -
MSR SymCrypt Rust+Lean+Aeneas 形式化验证 = 主动形式化验证 vs 被动漏洞补丁 双立标第 2 例 — 4 实例同源;建议
knowledge/risk.md §2.6 frontier lab × 安全工程 第 6 例 元方法学跟进 = 攻守双向补全的工程化样板
A4. evening 新增数据库 / 后端 / 云原生 / VecDB 立标(jay 1105/1300/1505/1735/1950/2105 briefing)
-
Bespoke OLAP arXiv:2603.02001 · ICLR 2026 接收 + UC Berkeley ADRS Blog = 工作负载特化 OLAP 引擎(CEB 51.40× speedup) — 1 实例单源(jay 2105 briefing D1);建议
knowledge/engineering.md v42 §2.8 + 数据库活文档新增+knowledge/llm-application.md v43 §1.1 训练时合成世界层 邻接 -
GenDB arXiv:2603.02081 = 基于代码生成的下一代 Query Processing 系统(对比 DuckDB v1.4.4 / ClickHouse / Umbra) — 1 实例单源(jay 2105 briefing D2);建议
knowledge/engineering.md v42 §2.8 -
HotPrefix ACM SIGMOD 2026(论文 3749168)+ CoDec + AlignedServe = 热度感知的 KV Cache 调度 + 前缀共享 + Prefix-aware Batching — 1 实例单源(jay 2105 briefing D3);建议
knowledge/inference.md §2.3 + §2.2 调度 沿用+knowledge/llm-infra.md §1.(3) KV cache 14+1 件套新增 SIGMOD 2026 三件套 -
pgvector 0.9 / Qdrant v1.14 / Milvus 2.6 / Weaviate v1.37 / Pinecone 2026 向量数据库决策矩阵 — 1 实例单源(jay 2105 briefing D4 + jay 1105 briefing D1 pgvectorscale 471 QPS);建议
knowledge/engineering.md v42 §2.13 选型决策树更新+knowledge/rag.md R51 §3 选型决策矩阵 -
llm-d v0.7.0 正式加入 CNCF Sandbox(KubeCon EU 2026)+ EPP 整合 + Inference Scheduler 新增初始 EPD(Prefill-Decode Disaggregation) — 1 实例单源(jay 2105 briefing B1);建议
knowledge/llm-infra.md §1.(10) SIGMOD 2026 三件套 沿用 + 新增 CNCF llm-d + Kthena -
Kthena:CNCF Volcano 子项目,LLM 推理路由编排系统(拓扑感知调度 + KV Cache 感知路由 + PD Disaggregation) — 1 实例单源(jay 2105 briefing B2);建议
knowledge/llm-infra.md §1.(10) 新增 Kthena -
Memory-Disaggregated LLM Inference HotInfra '26(ISCA 2026 workshop · CXL KV Cache + PIM-DIMM · DeepSeek-R1-671B 32K token 生成 · 39.7× cost reduction) — 1 实例单源(jay 2105 briefing B3);建议
knowledge/inference.md §2.3 KV cache 14 件套新增 CXL+knowledge/llm-infra.md §1.(3) KV cache 14+1 件套新增 -
LLM 推理指纹攻击 & CVE 威胁面(arXiv:2605.29979v1 + CVE-2026-22778 vLLM + CVE-2026-27893 vLLM + CVE-2026-5760 SGLang) — 1 实例单源(jay 2105 briefing B4);建议
knowledge/risk.md §2.1 ⑥ L0' 元层+dev 风险类目 第 3 例+knowledge/llm-infra.md §1.(4) Fail-Plausible -
vLLM vs SGLang 2026 关键定量数据(H100 SXM5 80GB + H200 + APC on/off + YottaLabs/Spheron/DeployBase 三源) — 1 实例单源(jay 2105 briefing B5 + jay 1735 briefing D1);建议
knowledge/llm-infra.md §1.(1) 推理引擎选型决策树更新 -
AI Agents Stack 2026 版(The AI Engineer Substack · swyx + Alessi · ~80K 订阅)= Memory 一等公民 + Context Engineering 取代 Prompt Engineering + MCP 标准化 + Agent Stack 六层架构 — 1 实例单源(jay 2105 briefing C1);建议
knowledge/llm-application.md v43 §1.1 + §1.3 + §1.2+knowledge/agent.md v37 §1.1+knowledge/ai-industry.md v34 §2.114 Substack 邻接
Tier B · 4★ 单实例高深度
B1. AI Engineer 1000+ JD 需求(jay 1735 briefing D5/D6)
- LLM Engineer vs AI Engineer vs GenAI Engineer 角色分层 — jay 单实例;建议
knowledge/ai-industry.md v34 §2 frontier lab 人才市场 邻接+knowledge/engineering.md v42 §6.3 锚点体系
B2. HF Training Agents 3(RL 训练智能体系列)+ HF 加入 Open Secure AI Alliance(stephen + flyp + spark)
- stephen 0910 X radar + flyp risk-e1prep 增量 6 + spark agent-e1prep;建议
knowledge/agent.md v37 §1.1 Harness 训练时 邻接+knowledge/ai-industry.md v34 §2.114.x
B3. Yann LeCun AMI Labs $1.03B 融资(stephen 0910 X radar + ai-industry 增量 6)
- researcher-driven frontier 路线第 3 例(Thinking Machines + SSI + AMI Labs 三联立);建议
knowledge/ai-industry.md v34 §2.66 researcher-driven frontier 路线三联立独立子节
B4. Hugging Face 8-1 blog 5 件(OlmoEarth · LFM2.5-Encoders · Cosmos-H-Dreams · Agent 入侵事件技术时间线 · GPU 管理)
- 美国厂商基础设施 5 件集中;建议
knowledge/ai-industry.md v34 §2.66 + §2.114 + §1 主线 7 VLA 飞轮(NVIDIA Cosmos-H-Dreams 第 2 家机器人仿真)+ §2 x86 Hack
B5. HF Daily 8-1 票榜 5 件新鲜榜首 + Metis 240▲ 重返
- AskChem 285▲ / Qwen-UI-Agent 265▲ / Metis 240▲ / PhiZero 150▲ / Frontis-MA1 144▲;建议
knowledge/ai-industry.md v34 §2.137.1 8-1 票榜 5 件新鲜榜首独立子目+knowledge/multimodal.md v35 §6 行业 8 主线 Qwen-UI-Agent 国内 GUI Agent 立标
B6. vLLM/SGLang H100 + H200 + GB300 NVL72 25× 推理性能提升(jay 1735 briefing D1)
- SGLang 2026 上半年快速追赶 + GB300 NVL72 rack-scale + MXFP4 量化格式;建议
knowledge/llm-infra.md §1.(1) 推理引擎选型决策树更新
B7. DUAL-BLADE ICDCS 2026 + KV Cache Transform Coding ICLR 2026 + Shadow in the Cache NDSS 2026 七大顶会议 KV-cache 集中爆发(spark llm-infra-e1prep)
- spark 单实例;建议
knowledge/llm-infra.md §1.(3) KV cache 14+1 件套新增 DUAL-BLADE + Transform Coding + Shadow in the Cache+knowledge/llm-infra.md §1.(10) 七大顶会议 KV-cache 集中爆发立标
B8. Microsoft Echoverse + Open Secure AI Alliance + SymCrypt 元方法学跟进
- MSR 单实例双立标;建议
knowledge/risk.md §2.6 frontier lab × 安全工程 第 6 例 元方法学跟进+knowledge/llm-application.md v43 §1.4 + §5 #9
Tier C · 3★ 数据点 / 行业新闻
- LlamaParse 智能路由 · PDF 解析成本降 50-90%(jay 1050-1240) — 工程化层
- LFM2.5-Encoders · CPU 长文本编码器 3.7× ModernBERT(stephen 1003 HF blog) — 工程化层
- pgvectorscale 471 QPS @ 99% recall · 11.4× Qdrant(jay 1105 briefing) — VecDB 选型
- Kimi K3 2.8T 原生视觉 · BenchLM 多模态/Grounded #2/32 89.6/100(stephen + jay + flyp 三实例覆盖但具体视角不同)
- DeepSeek-V4-Flash-0731 + Solar-Open2-250B + Qwen-UI-Agent 265▲ 三连开源(jay 0950 + stephen 1004) — 国内主线立标
- Anthropic Project Glasswing(8-1 YT) —
ai-industry.md v34 §1.3邻接 - HF Training Agents 3(强化学习训练智能体系列)(7-28 HF blog) —
ai-industry.mdagent 邻接 - Open Secure AI Alliance · HF 加入 NVIDIA 牵头联盟(7-27 HF blog) —
ai-industry.md治理邻接 - Thinking Machines Inkling-Small 7-31 + Inkling 7-16 两档策略 —
ai-industry.md v34 §2.66 frontier lab 模型档位策略独立小节 - OpenAI Abundant Intelligence 8-1 新战略口号(待核实) —
ai-industry.md v34 §2.140 沿用
六、分类标签汇总(evening 完整态)
agent:
- Sigma-Mem Online Reliability Memory (multi-agent trust memory)
- Filesystem-Based Memory (filesystem-default agent memory)
- MisKnow-Agent (along R50)
- Inkling-Small + Inkling two-tier
- ByteByteGo ChatGPT Agent Loop three-tier (harness+API+inference)
- Lilian Weng Harness Engineering eight-tuple formula + three design patterns
- MirrorCode Benchmark (METR/Epoch AI)
- Project Glasswing (Anthropic software safety)
- Anthropic cybersecurity 3-real-incident disclosure
- Mythos HAWK/AES cryptographic weaknesses
- Anthropic AI for Science rare-disease grants $50K
- HF Training Agents 3 (RL on local/open weights)
- Open Secure AI Alliance (NVIDIA + Anthropic + Google + HF)
- Microsoft Echoverse (synthetic world training)
- Microsoft SymCrypt Rust+Lean+Aeneas formal verification
- sigma-mem candidate K (memory trust modeling)
- filesystem candidate J (filesystem-default agent memory)
- AI Agents Stack 2026 Edition (swyx + Alessi Substack)
- Memory-as-attack-surface #1 (Metis) / #2 (StealthBench) / #3 (Cyber-Capable)
- Trust-modeling-as-attack-surface three-link (Σ-Mem + Cyber-Capable + StealthBench)
- Filesystem-as-attack-surface four-link (Filesystem + Σ-Mem + Cyber-Capable + StealthBench)
- Deep-research-as-attack-surface three-link (MisKnow-Agent + Cyber-Capable + StealthBench)
rag:
- BM25 Wins at Scale (RAG paradigm scaling counter)
- DualG-MRAG multimodal rag decoupling
- GLM-RAG Graph Language Model retriever
- ConMem contribution-aware memory manufacturing
- See2Think intermediate visual states benchmark (rag邻接)
- OmniScope, Fairness Pruning (radar other candidates)
- DeepDiver (omitted by jay 0821 csdn)
- VisionRAG (no-OCR image-level indexing)
- GraphRAG + AgenticRAG 2026 practical chain
- pgvector 0.9 / pgvectorscale 471 QPS (jay 1105 briefing)
- pgvector 0.9 / Qdrant / Milvus / Weaviate / Pinecone 2026 decision matrix (jay 2105 briefing)
- 20 Advanced RAG Types (Future AGI / Turing Post) (jay 2105 briefing)
- FutureAGI RAG Reimagined 5 Breakthroughs (GradientFlow Substack + Douwe Kiela + Nvidia OP-RAG)
- FutureAGI RAG 五指标体系 (Chunk Utilization + Attribution + Context Relevance + Context Precision + Faithfulness)
multimodal:
- ShadowDancer shadow learning world model
- CoMem deep-role-division unbounded context
- LEDGERMIND evidence ledger traceable inference
- See2Think VAoT diagnostic
- Kimi K3 2.8T native vision BenchLM #2/32
- Qwen-UI-Agent 265 (GUI foundation)
- Gemini Robotics 2 (GoogleDeepMind 7-30 rerun)
- DeepMind On-Device 2 + ER 2 video understanding
- Apptronik Apollo 2 joint demo
- Visual Patch World world-model-third-paradigm
- ActiveVision + Trace + Show Don't Tell (four-metric cluster)
- PhiZero physical language world model (HF Daily 8-1 150▲)
- Qwen-UI-Agent GUI foundation Agent (HF Daily 8-1 265▲)
engineering / systems:
- ByteByteGo agent loop three-tier
- Lilian Weng Harness Engineering eight-tuple formula + three patterns
- MirrorCode benchmark
- LlamaParse intelligent routing (50-90% cost cut)
- LFM2.5-Encoders CPU 3.7x ModernBERT
- pgvectorscale 471 QPS 11x Qdrant
- CIDR 2026 PostgreSQL decoupled vector search
- LanceDB embedded zero-server
- vLLM speculative decoding source-code analysis
- DeepSeek-V4-Flash-0731 / Solar-Open2-250B deployment
- Kimi K3 2.8T MXFP4 quantization deployment
- SymCrypt Rust verification + Echoverse (MSR)
- Harness Engineering for Self-Improvement (Lilian Weng)
- Simon Willison MCP 2.0 stateless HTTP format + uvx mcp-explorer
- Bespoke OLAP ICLR 2026 51.40× speedup
- GenDB next-generation query processing
- HotPrefix SIGMOD 2026 hotness-aware KV cache
- llm-d v0.7.0 CNCF Sandbox + Kthena Volcano subproject
- CXL Memory-Disaggregated HotInfra 2026 39.7× cost reduction
- LLM fingerprinting attack + CVE-2026-22778/27893/5760
- vLLM vs SGLang H100/H200/GB300 2026 quantitative data
- AI Agents Stack 2026 Edition (swyx Substack)
inference / llm-infra:
- GoodServe arXiv:2605.16867 E2E-SLO goodput scheduling
- AMPD arXiv:2602.14516v2 multi-round PD disaggregation
- LAAR arXiv:2604.15732v1 NUMA-aware long-context routing GH200
- Token-Operations Oriented Inference Optimization arXiv:2606.20295v1 four-tier
- Harvest arXiv:2602.00328v1 P2P GPU cache 43.48% utilization
- Agent Memory arXiv:2603.04428v1 Edge Q4 KV cache persistence
- MCP 2.0 + Lilian Weng Harness + ByteByteGo OpenAI Agent Loop = Agentic 推理三层架构收敛
- SuperInfer arXiv:2601.20309v2 GH200 superchip inference
- KernelSight-LM arXiv:2606.28565v1 kernel-level inference simulator
- KV Cache 顶会三件套 (DUAL-BLADE ICDCS 2026 + KV Cache Transform Coding ICLR 2026 + Shadow in the Cache NDSS 2026)
- 七大顶会议 KV-cache 集中爆发立标 (SIGMOD + SIGCOMM + HPCA + ACL + ICDCS + ICLR + NDSS)
risk:
- Shadow in the Cache arXiv:2508.09442 NDSS 2026 KV-cache privacy/side-channel (P0 警示)
- Σ-Mem arXiv:2607.27958 trust-modeling-as-attack-surface three-link (P1)
- Filesystem-Based Memory arXiv:2607.26637 filesystem-as-attack-surface four-link (P1)
- MisKnow-Agent arXiv:2607.20891 deep-research-as-attack-surface three-link (P1)
- EU AI Act 2026-08-02 deadline 24h 临门 (P0 监管)
- OpenAI 8-1 捣毁柬埔寨诈骗犯罪团伙 (P2)
- HF 加入 Open Secure AI Alliance (P3 第 4 立家)
- MSR SymCrypt Rust 形式化验证 (P3 元方法学跟进)
- R34 §2.1 ① StealthBench P0 沿用
- R34 §2.1 ② Metis P1 沿用 + 第 3 拍
- R34 §2.1 ③ Memory for LLMs 综述 P1 沿用
- R34 §2.1 ④ Graph-Native Bitemporal P1 沿用 + Anthropic 7-30 沿续
- R34 §2.1 ⑥ CVE-2026-22778 vLLM CVSS 9.8 P0 + Shadow in the Cache 第 2 例
- R34 §2.1 ⑦ Opus 4.7 三起真实系统攻击 P0 沿用
- R34 §2.1 ⑧ Opus 5 + EU AI Act 8-2 临门 + frontier lab × 监管 × 国际协作 三栖对位 第 1 例
- R34 §2.x Cyber-Capable AI Agents P2 沿用 + filesystem/trust-modeling/deep-research 三联立/四联立
- frontier lab × 安全工程 #6/#7/#8 例 + 第 4 立家
- α 14 维 + 反身性 21 轨 + 防御表 78 → 82 行
substack / industry weekly:
- r.jina.ai / jlelse substack / Latent Space (swyx) / Last Week in AI (week-31 summary missing)
- jamwithai infrastructure RAG FastAPI stack
- interconnects Nathan Lambert (Decoding AI)
- cameron-wolfe Substack
- chip-huyen pitfalls + agents + genai-platform
- gradient-flow specialized-AI + data-center-economics
- **AI Agents Stack 2026 Edition (swyx + Alessi Substack, 80K 订阅)** (jay 2105 briefing C1 evening 新增)
- The AI Engineer Substack swyx 80K 订阅
- AI Engineer 1000+ JD 角色分层 (jay 1735 briefing D5/D6)
database / backend / cloud-native:
- Bespoke OLAP ICLR 2026 (workload-specialized synthesis, 51.40× speedup)
- GenDB next-generation query processing (LLM code generation)
- HotPrefix SIGMOD 2026 (hotness-aware KV cache scheduling + prefix sharing)
- pgvector 0.9 / pgvectorscale 471 QPS @ 99% recall
- Qdrant v1.14 / Milvus 2.6 / Weaviate v1.37 / Pinecone 2026 决策矩阵
- llm-d v0.7.0 CNCF Sandbox + Kthena Volcano subproject
- CXL Memory-Disaggregated HotInfra 2026 39.7× cost reduction
- vLLM/SGLang H100/H200/GB300 2026 定量数据 + CVE-2026-22778/27893/5760
七、建议写入路径(按 GitHub-ready 草稿要求)
不直接写 published/,等统一同步任务处理。本稿只列出"建议路径 + 内容大纲"。
7.1 主线活文档(按共享知识库写入规则)
| 路径建议 | 内容大纲 | 来源实例 |
|---|---|---|
knowledge/ai-industry.md v33 → v34 升级 |
8 条增量(Inkling-Small + OpenAI EU 治理 + HF Daily 8-1 票榜 + HF blog 5 件 + Anthropic 网络安全 3 起事件 + Glasswing + Inkling-Small + HF Training Agents 3)+ 主线 §1.3 治理新增「EU AI Act 8-2 临门联动手」独立小节 + 4 主线候选升档 = 主线 (177)-(180) | Stephen |
knowledge/rag.md R50 → R51 接力 |
9 件候选(Σ-Mem / Filesystem / DualG-MRAG / GLM-RAG / ConMem / See2Think / BM25 / OmniScope / FairnessPruning)+ §2.17 候选 J/K/L 三件记忆架构新立 + §2.16 RAG 范式规模化对照基线升级 + §2 主线多模态 RAG 重申 | Tom |
knowledge/multimodal.md v34 → v35 接力 |
14 件候选增量(See2Think + ShadowDancer + LEDGERMIND + CoMem + DualG-MRAG + Kimi K3 + 7 延伸追踪)+ 评测方法学二十三面体四联升级到五联("答案接口 + 任务设计 + 训练环境 + 中间产物使用 + 证据账本")+ 主线 2 长上下文邻接 CoMem | Flyp |
knowledge/engineering.md v41 → v42 接力 |
~30 条增量(6 条 engineering-e1prep + 5 条 1105 briefing + 6 条 1300 briefing + 5 条 1505 briefing + 4 条 1735 briefing + 10 条 2105 briefing)+ §2.7 Agentic Engineering 学科化补 ByteByteGo 三层架构生产实例 + 6 engineering MirrorCode benchmark + §2.95 evaluation discipline 新增 + §2.13 选型决策树更新 + §2.15 推理工程安全补 SymCrypt + §2.8 VLDB 2026 Demos 补 Bespoke OLAP/GenDB + §2.14 ICLR 2026 MemAgents Workshop 补 MSR Echoverse | Jay |
knowledge/llm-application.md v42 → v43 接力 |
8 件净增量(5 重大 + 3 旁证)= ByteByteGo 三层架构 + MSR Echoverse + MirrorCode + FutureAGI 五指标 + Fairness Pruning + BM25/OP-RAG + SymCrypt 形式化验证 + MCP 2.0 stateless + Σ-Mem 第五路 Memory + Lilian Weng 八元组 + Mythos 密码学 + AI Agents Stack 2026 Edition (swyx Substack 80K 订阅) | Stephen |
knowledge/inference.md 升级(tom 维护) |
8 件净增量(6 主线 + 2 旁证)= GoodServe E2E-SLO goodput + AMPD Multi-round PD 分 离 + LAAR NUMA-aware long-context routing + Token-Operations 四层架构 + Harvest P2P GPU cache + Agent Memory Edge Q4 KV + MCP 2.0 + Lilian Weng Harness + ByteByteGo OpenAI Agent Loop + SuperInfer GH200 + KernelSight-LM + KV Cache 顶会三件套(沿用 llm-infra.md) | Tom |
knowledge/llm-infra.md 升级(spark 维护) |
7 主线 + 3 旁证 + 2 警示 = KV Cache 顶会三件套 + Agentic Serving 三件套 + AIConfigurator + Fluid-Guided + 推理引擎 4 选 1 + MCP 2.0 + MSR Echoverse + MSR SymCrypt + §IX 关键拐点 12 件 | Spark |
knowledge/risk.md R34 → R35 接力 |
7 条 net-new 增量 + 1 强提醒 + 1 元方法学 = Shadow in the Cache NDSS P0 + Σ-Mem trust-modeling-as-attack-surface 三联立 + Filesystem filesystem-as-attack-surface 四联立 + MisKnow-Agent deep-research-as-attack-surface 三联立 + EU AI Act 8-2 24h 临门 + OpenAI 8-1 捣毁 + HF Open Secure AI Alliance + MSR SymCrypt + frontier lab × 安全工程 第 6/7/8 例 + 第 4 立家 + α 14 维 + 反身性 21 轨 + 防御表 78 → 82 行 | Flyp |
knowledge/agent.md v36 → v37 接力 |
6 件 P0/P1 立标候选 + 2 件 P1/P2 邻接 + 1 件警示 + 1 件反方 + 1 件状态变化 = Σ-Mem + Filesystem + DualG-MRAG + GLM-RAG + MisKnow-Agent + ConMem + CoMem + ByteByteGo 三层架构 + Lilian Weng Harness Engineering + MirrorCode + MSR Echoverse + MSR SymCrypt + Simon Willison MCP 2.0 + OpenAI 8-1 捣毁诈骗犯罪 + Project Glasswing + Open Secure AI Alliance + EU AI Act 8-2 deadline 临门 | Spark |
7.2 review / metadata / digests
| 路径建议 | 内容 | 来源 |
|---|---|---|
/shared/research-kb/review/2026-08-01-evening-coverage.md |
本协调稿精简版(仅保留覆盖度 + Tier A/B + 冲突 + 缺口 + 写入路径) | Stephen |
/shared/research-kb/metadata/coverage-matrix-2026-08-01-evening.md |
十向覆盖度矩阵 + 冲突表 + 缺口表(一表式) | Stephen |
/shared/research-kb/digests/2026-08-01-stephen-evening.md |
同上 | Stephen |
7.3 inbox 草稿(已写入)
| 路径(实际写入) | 大小 | 状态 |
|---|---|---|
/shared/research-kb/inbox/stephen/2026-08-01-1245-stephen-coordination-check-noon.md |
~25 KB | ✅ 已写入 |
/shared/research-kb/inbox/stephen/2026-08-01-2245-stephen-coordination-check-evening.md |
~28 KB | ✅ 本稿即此 |
八、是否需要精读 / 审稿 / 主题页更新
8.1 需要精读(PDF 全文 / 跨代对照)
| 篇 | 必做动作 | 时限 |
|---|---|---|
| arXiv:2607.26497 BM25 Wins at Scale | PDF 全文 + Reader sensitivity 3+ 档 + 生产 harness 对照 + 跨语料外推 | 8-1 → 8-5 |
| arXiv:2607.26637 Filesystem-Based Memory | PDF 全文 + 5 RQ 全部核 + 50/100/200 session 长期 horizon 曲线 | 8-1 → 8-5 |
| arXiv:2607.28580 DualG-MRAG | PDF 全文 + HM-RAG/MMAgent-R² head-to-head + AcademicEval 对照 | 8-1 → 8-5 |
| arXiv:2607.28397 GLM-RAG | PDF 全文 + 评测设计验证 + DualG-MRAG 对照 | 8-2 → 8-6 |
| arXiv:2607.27958 Σ-Mem | PDF 全文 + 在 AgentLoom / MCTS-RAG 上的对照 + paper_cards/683 已建 | 8-2 → 8-6 |
| arXiv:2607.28126 ConMem | PDF 全文 + 工业场景复现路径 | 8-3 → 8-7 |
| arXiv:2607.26769 See2Think | PDF 全文 + VAoT 可解释性方法依赖 + 跨模态覆盖度验证 | 8-1 → 8-5 |
| arXiv:2607.28362 ShadowDancer | PDF 全文 + 演示视频采集成本披露 + 跨动力学鲁棒性 | 8-3 → 8-7 |
| arXiv:2607.28263 CoMem | PDF 全文 + 在开箱即用模型 + MLLM 上的实证 | 8-3 → 8-7 |
| arXiv:2607.28374 LEDGERMIND | PDF 全文 + 多模态工具统一表达评估 | 8-3 → 8-7 |
| arXiv:2508.09442 Shadow in the Cache | NDSS 2026 KV-cache 隐私/侧信道(paper_cards ⚠️ 未建卡,优先级最高)+ 缓解方案具体实现 + vs CVE-2026-22778 vLLM 修复路径 + vs SafeKV+PrefixWall 关系 head-to-head + vs MCP 2.0 authorization hardening 集成路径 | 8-2 立即 |
| arXiv:2605.16867 GoodServe | PDF 全文 + GPU 异构资源下最大化 goodput 的在线调度框架 | 8-2 → 8-6 |
| arXiv:2602.14516v2 AMPD | PDF 全文 + vs Dynamo 静态分离 head-to-head + SWE-Bench/BFCL 验证 | 8-2 → 8-6 |
| arXiv:2604.15732v1 LAAR | PDF 全文 + numactl NUMA 亲和性 + Envoy EPP 接入 llm-d MaxScorePicker + GH200 NVL2 实测 | 8-2 → 8-6 |
| arXiv:2606.20295v1 Token-Operations | PDF 全文 + 四层架构 + P-EAGLE/MeanCache/Cortex 2026 新技术 + 140T tokens/day 中国数据 | 8-2 → 8-6 |
| arXiv:2602.00328v1 Harvest | PDF 全文 + FlexPipe 两大云厂商两周实测 + DeepSeekV3/Mistral-Large-3-675B/Kimi-K2 传输时间 | 8-2 → 8-6 |
| arXiv:2603.04428v1 Agent Memory | PDF 全文 + Edge Q4 KV Cache + vllm-mlx 21-87% vs llama.cpp + 78.5s dead time | 8-2 → 8-6 |
| arXiv:2601.20309v2 SuperInfer | PDF 全文 + GH200 KV cache offloading + NVLink-C2C | 8-3 → 8-7 |
| arXiv:2606.28565v1 KernelSight-LM | PDF 全文 + GB200 Tier B vs AIConfigurator + Vidur 对比 | 8-3 → 8-7 |
| arXiv:2511.01815 KV Cache Transform Coding | PDF 全文 + 相对 KVQuant 6× 的精度损失曲线 + ICLR 2026 论文 | 8-2 → 8-6 |
| arXiv:2604.26557 DUAL-BLADE | PDF 全文 + ICDCS 2026 + prefill -33.1% / decode -42.4% / SSD 2.2× | 8-2 → 8-6 |
| arXiv:2603.02001 Bespoke OLAP | PDF 全文 + ICLR 2026 + TPC-H 12.35× / CEB 51.40× speedup + UC Berkeley ADRS | 8-2 → 8-6 |
| arXiv:2605.29979v1 LLM Fingerprint | PDF 全文 + 2026 CVE-2026-22778/27893/5760 攻防 | 8-3 → 8-7 |
| arXiv:2603.02081 GenDB | PDF 全文 + DuckDB v1.4.4/ClickHouse v26.2.1/Umbra/MonetDB/PostgreSQL v18.2 | 8-3 → 8-7 |
8.2 需要审稿(反方)
- flyp 8-1 10:30 周六精读 + 反方审稿(已就位 6 条证伪线 / 件)
- 本协调稿已在 §四 列出"潜在冲突"10 条,全部需人工确认
- stephen llm-application-e1prep 列出 12 条反方警示 + jay engineering-e1prep 列出 5 条警示 + tom inference-e1prep 列出 6 条警示 + flyp risk-e1prep 列出 8 条待核实说法 = 31 条反方/警示需统一回访
8.3 主题页更新(活动 v34/v35/v41/v42/...窗口编排)
| 主题页 | 上次更新 | 距今 | 是否需要编排 | 建议 |
|---|---|---|---|---|
| ai-industry v33 | 7-31 22:45 CST | ~24h | ✅ 启动 v34 编排 | 今晚由 stephen 启动 |
| rag R50 | 8-1 凌晨 | ~22h | ✅ 启动 R51 编排 | 今晚或明天由 tom 启动 |
| multimodal v34 | 7-28 08:40 CST | ~110h | ✅ 启动 v35 编排(已超 3 天红线 38h) | 今晚由 flyp 启动(最紧迫) |
| engineering v41 | 7-31 17:35 CST | ~29h | ✅ 启动 v42 编排 | 今晚由 jay 启动 |
| LLM application v42 | 8-1 11:20 CST | ~11h | ✅ 启动 v43 编排 | 今晚由 stephen 启动 |
| inference | 8-1 22:24 CST | ~0.5h | ✅ 启动新版本编排 | 今晚由 tom 启动 |
| llm-infra | 7-31 18:47 CST | ~28h | ✅ 启动新版本编排(§IX 关键拐点 12 件已就位) | 今晚由 spark 启动 |
| risk R34 | 8-1 00:30 CST | ~22h | ✅ 启动 R35 编排 | 今晚或明天由 flyp 启动 |
| agent v36 | 7-31 16:20 CST | ~30h | ✅ 启动 v37 编排 | 今晚或明天由 spark 启动 |
编排优先级(按紧迫度从高到低): 1. multimodal v34 → v35(超 3 天红线 38h,最紧迫) 2. engineering v41 → v42(饱和增量 ~30 件) 3. llm-application v42 → v43(8 件净增量 + 跨实例共识度极高) 4. inference / llm-infra(双活文档同步升级,6+5 主线) 5. ai-industry v33 → v34(12 件 paper_cards 待建卡) 6. risk R34 → R35(7 条 net-new + memory-as-attack-surface 体系扩展) 7. agent v36 → v37(6 P0/P1 + 2 P1/P2 + 1 警示) 8. rag R50 → R51(9 件候选 + §2.17 J/K/L)
九、本稿状态
- ✅ 本稿即写入
/shared/research-kb/inbox/stephen/2026-08-01-2245-stephen-coordination-check-evening.md - ⚠️ 暂未写入
published/· 未执行git commit / push / gh pr - 📌 Substack 周度缺口 = 下次启动素材(已部分补 swyx 1 条)
- 📌 9 条主线活文档编排窗口建议今晚统一启动(特别是 multimodal 已超 3 天红线 38h · 最紧迫)
- 📌 HF Daily 8-1 票榜 15 件中 12 件 paper_cards ⚠️ 未建(特别是 PhiZero + Frontis-MA1 + Memory Decoder at Scale 三大立标候选)
- 📌 Shadow in the Cache arXiv:2508.09442 NDSS 2026 paper_cards ⚠️ 未建(风险主线 P0 警示优先级最高)
十、最后一句话
今天 5 实例合计 ~35 篇新草稿(evening 部分),跨 10 主线(agent/rag/multimodal/engineering/systems/csdn/substack/risk/llm-application/llm-infra)覆盖度均达"极高",9 条主线活文档编排窗口今晚待启动(特别是 multimodal 已超 3 天红线 38h · 最紧迫),31 条反方/警示需统一回访,12 件 HF Daily 8-1 票榜 + 1 件 Shadow in the Cache paper_cards 缺失待补建,3 项新增立标信号需在 v34/v35/v42/v43 同步落点(KV Cache 顶会三件套 + Agentic Serving 调度三件套 + Frontier lab × 监管/安全/治理 联动)。Anan 收到本稿后,建议优先关注 §三(十向覆盖度)+ §四(冲突 + 缺口)+ §八.3(编排优先级),决定哪些主题活文档窗口今晚启动、哪些留到明天。