Stephen 总协调检查 · 2026-06-28 午间
生成时间:2026-06-28 12:45 Asia/Shanghai
实例:Stephen
性质:跨实例协调草稿;不执行 git commit / git push / gh pr;不直接写入 published。
0. 与上棒的关系
- 上棒(6-27 12:45)路径:
/shared/research-kb/inbox/stephen/2026-06-27-stephen-coordination-check.md - 本棒覆盖 6-27 12:45 → 6-28 12:45 的新增产出,定位为 6-28 morning 收口(晚棒 22:45 接管 12:45 → 22:45)。
- 6-27 evening 棒缺失(Stephen 实例未产出 6-27 evening 协调检查,详见 §10 缺口)
- 6-28 morning 合计新增草稿 17 份:stephen 7 份(0157 RSS 信源抓取)/ tom 2 份(08:40 radar + 09:00 hf-daily)+ 1 候选 JSON / jay 10 份(4 份 RSS + 6 份研究稿)/ flyp 1 份(09:50 周日反方审稿 Jets + RM-Bench)/ Spark 持续 18 天空档(cron review 11:25 已恢复 ✅)。
- 与 6-27 morning 棒的关键差异:6-28 morning 是 flyp 周日反方审稿棒(cron:3d8f503a 周日)+ jay 三场研究稿汇流(上午 OWASP+Grab+Cognee / 工程排障 / 下午 Vector DB+推理+K8s+Substack)+ stephen 7 份 0157 RSS 行业头部新闻抓取(首次覆盖 OpenAI / Anthropic / DeepMind / HF Blog / Ben's Bites / TLDR AI / Google AI 七信源)。
1. 本次主题
对 2026-06-27 12:45 → 6-28 12:45 各实例研究简报做跨实例协调收口,重点:
- 🔥 KV Cache 压缩范式 2026 突破(jay 6-28 11:08 + 11:09 双稿):7 范式(MHA/MQA/GQA/MLA/LRKV/MLRA/GQLA/CCGQA)+ 6 arXiv 论文(2601.11471 / 2604.26968 / 2603.02188 / 2605.15250 / 2601.11464 / 2510.04476),关键数字 57x 内存过度配置 → 7.4x batch size → 47% 成本降低 + 8x KV cache 压缩无性能下降。
- 🔥 推理引擎三分天下 vLLM/SGLang/TRT-LLM(jay 6-28 11:08):2026 H100 基准 + SGLang +29% 优势(DeepSeek/MoE/前缀复用)+ SGLang NSA + TRT-LLM decode backend Blackwell 3-5x 加速 + vLLM MRV2 GB200 +56%。
- 🔥 Vector DB 2026 选型 + ⚠️ pgvector CVE(jay 6-28 11:08):分层选型(pgvector/Qdrant/Milvus/Pinecone/Weaviate)+ Qdrant v1.18 TurboQuant + Milvus 3.0 zero-copy + CVE-2026-3172:7 天内升级生产 PG 实例。
- 🔥 Substack 高质量研究信源爆发(jay 6-28 单日净增 11 条 Substack):上午 7 条(The AI Engineer / Bhavishya Pandit / Alex Ewero × 2 / Cognee / OpenCode / Jo Van Eyck YouTube)+ 下午 4 条(Nathan Benaich State of AI: May 2026 / LLMs Research / AI Evaluation Digest / Simon Willison)—— 创单日 Substack 净增历史新高。
- 🔥 行业头部大新闻(stephen 0157 RSS 7 信源):OpenAI + Broadcom Jalapeño inference chip(自研推理芯片)/ OpenAI GPT-5.6 Sol 预览 / DeepMind Gemini 3.5 Flash computer use / DeepMind $10M 多 Agent 安全资金 / Google AMIE 疾病管理 Nature 论文 / OpenAI Appia Foundation 共享标准 / Anthropic Claude Tag / ⚠️ Anthropic Fable 5 / Mythos 5 被美政府暂停(监管风险)。
- 🔥 flyp 周日反方审稿(flyp 6-28 09:50):(A) Jets(ICLR 2026 poster)反方评分 B+(理论★★★★ + 实验★★ + 无 SAE 对比★★)+ (B) RM-Bench(NeurIPS 2024 Accept Oral)反方评分 A-(评测硬★★★★ + SOTA 平均 46.6% < 随机 50%)+ 与 RewardBench 2 对照分析。
- 🔥 tom 周日轻量雷达(tom 6-28 08:40):4 高价值(MemStrata 5 天内第 3 次出现 + GauntletBench + Progress Advantage + CoffeeBench)+ 4 候选(多模型失败上限 arXiv 2606.27288 67 frontier models + PhysRAG + LISA + ABACUS)+ ⚠️ Substack 0 条。
- 🔥 AI Agent 工程栈全景(jay 6-28 morning brief):The AI Engineer 六层架构(2024 → 2026 演进三层)+ Grab + LangGraph 多 Agent 生产案例(FastAPI + LangGraph)+ OWASP Top 10 ASI 完整版 + OpenCode 160K stars + Cognee graph-vector 混合架构(每月 100 万+ pipeline)。
- 🔥 生产 Agent 排障 SRE 工程(jay 6-28 1050):11 保留(Datadog 5%→2% 错误率 + 840 万次 rate limit 错误 / buildmvpfast 50KB/span trace + 67.6% token 在 tool responses / Arize Skills as Markdown Runbooks / MLflow SLO+Circuit Breaker+Deterministic Code / RAGPerf arXiv 2603.10765 多模态 RAG benchmark / Anthropic Decoupling the Brain from the Hands)。
- 🔥 Sebastian Raschka RSS 5 条(jay 6-28 0053):Recent Developments in LLM Architectures: KV Sharing, mHC, Compressed Attention 🔥(与 jay KV cache 双稿完美呼应)+ Local Coding Agents + LLM Research Papers 2026 List + Workflow for Understanding LLM Architectures + Components of A Coding Agent。
- 🔥 ByteByteGo RSS 5 条(jay 6-28 0053):EP220: RAG vs Graph RAG vs Agentic RAG 🔥 + Top Anti-Patterns + Large vs Small LLMs + An Ex-Meta L8's Agentic Engineering Setup 🔥 + AI-Native Leaders Organizational Playbook。
- 🔥 HF Daily 6-28 高票:#1 Are We Ready For An Agent-Native Memory System? 104▲(比 6-27 102▲ 又 +2,连续 3 天同主题)+ #4 In-Context World Modeling for Robotic Control 42▲(机器人+世界模型新主题浮现)+ #10 MVTrack4Gen: 4D Video Generation 34° + #15 Fast LeWorldModel 22°。
2. 检索范围与本轮输入
2.1 本轮已核对草稿(截至 2026-06-28 12:45 UTC+8)
/shared/research-kb/inbox/tom/(6-28 morning 共 2 份 + 候选 JSON 已更新)
- 2026-06-28-agent-rag-longcontext-radar.md(08:40,3.6KB,morning radar · 4 高价值 + 4 候选 + Substack 0)
- 🔴 MemStrata(arXiv 2606.26511,2026-06-25 v1)—— tom 6-26 evening + 6-27 morning + 6-28 morning 5 天内第 3 次出现(同源高频)
- 🔴 GauntletBench(arXiv 2606.14397,2026-06-24)—— 时间感知/图形理解/跨维度泛化三大能力;HF Daily 票数 15
- 🔴 Progress Advantage(arXiv 2606.26080,2026-06-23)—— RL post-training 隐含 step-level 评分信号
- 🔴 CoffeeBench(arXiv 2606.16613,2026-06-14)—— 多智能体经济系统(农民/烘焙商/零售商)跨超长周期
- 🟠 多模型路由/投票/级联系统的失败上限(arXiv 2606.27288,67 frontier models,beta = all-models-wrong rate)
- 🟠 PhysRAG(arXiv 2606.26916)/ LISA(arXiv 2606.27192)/ ABACUS(arXiv 2606.23835)
- Substack 1 缺口:未发现与 Agent+RAG+长上下文高度相关的 Substack(搜索范围:substack.com/newsletter)
- 与 6-27 radar 对比:MemStrata 重复出现(6-27 #1 → 6-28 #1);GauntletBench / Progress Advantage / CoffeeBench 是 6-27 未覆盖新条目;多模型失败上限是 6-27 未覆盖新条目;PhysRAG / LISA / ABACUS 是 6-27 候选延续
- 2026-06-28-0900-hf-daily-2026-06-28.md(09:00,1.8KB,HF Daily Papers 15 篇按票数排序)
- 🔴 [104▲] Are We Ready For An Agent-Native Memory System?(arXiv 2606.24775)—— 比 6-27 102▲ 再 +2,HF 社区连续 3 天同主题
- 🟠 [64▲] DanceOPD(arXiv 2606.27377)/ [62▲] DomainShuttle(arXiv 2606.26058)/ [44▲] ShutterMuse(arXiv 2606.25763)
- 🟠 [42▲] In-Context World Modeling for Robotic Control(arXiv 2606.26025)—— 新主题:机器人 + 世界模型(与 MVTrack4Gen + Fast LeWorldModel 形成"3D / 世界模型"主题群)
- 🟡 [40▲] OPID(arXiv 2606.26790)/ [40▲] Qwen-Image-Agent(arXiv 2606.26907)/ [38▲] The Verification Horizon(arXiv 2606.26300)/ [37▲] ViQ(arXiv 2606.27313)
- 🟡 [34▲] MVTrack4Gen: 4D Video Generation(arXiv 2606.26087)/ [29▲] JetSpec(arXiv 2606.18394)/ [25▲] GUI vs. CLI(arXiv 2606.24551)/ [25▲] V-Zero(arXiv 2606.25319)
- 🟢 [24▲] UnityShots(arXiv 2606.21661)/ [22▲] Fast LeWorldModel(arXiv 2606.26217)
- 与 6-27 HF Daily 对比:#1 主题延续;#4 In-Context World Modeling 是新浮现主题;MVTrack4Gen + Fast LeWorldModel 共同形成"3D / 世界模型 / 机器人控制"主题群
2026-06-28-agent-rag-longcontext-candidates.json(08:40,9.5KB)—— 已同步到_candidates/
/shared/research-kb/inbox/jay/(6-28 morning 共 10 份:4 RSS + 6 研究稿)
- 2026-06-28-0053-rss-raschka.md(00:53,1.2KB,Sebastian Raschka RSS 5 条)
- 🔥 Recent Developments in LLM Architectures: KV Sharing, mHC, Compressed Attention —— 与 jay 6-28 11:08 + 11:09 KV cache 双稿完美呼应
- Using Local Coding Agents / LLM Research Papers: 2026 List (Jan-May) / Workflow for Understanding LLM Architectures / Components of A Coding Agent
- 2026-06-28-0053-rss-bytebytego.md(00:53,1.4KB,ByteByteGo RSS 5 条)
- 🔥 EP220: RAG vs Graph RAG vs Agentic RAG —— 与 jay 6-27 1221 #8 + jay 6-28 0822 #1 GraphRAG 完美呼应
- 🔥 An Ex-Meta L8's Agentic Engineering Setup —— 与 jay 6-28 1050 工程排障主题呼应
- Top Anti-Patterns / Large vs Small LLMs / AI-Native Leaders Organizational Playbook
- 2026-06-28-0053-rss-cool-papers.md(00:53,1.8KB,Cool Papers cs.CL 5 条)
- Empowering GUI Agents via Autonomous Experience Exploration + Multilingual Reasoning Cascades Need More Context
- Mapping Political-Elite Networks / LLM-Based Examination of Eligibility Criteria / Beyond Surface Forms ILE Detection
- 2026-06-28-0053-rss-cool-papers-ir.md(00:53,1.7KB,Cool Papers cs.IR 5 条)
- 🔥 NOVA: Verification-Aware Agent Harness for Architecture Evolution in Industrial Recommender Systems(arXiv 2606.27243)—— 与 jay 6-28 1050 工程排障 + Anthropic Harness design 主题呼应
- TRUST: Item-Calibrated Interval Evidence / UniFormer: Efficient Unified Model-Centric Scaling / TriPAH: Cross-Modal Medical Retrieval / IPTC Topic Space
- 2026-06-28-csdn-rag-agent-mlops.md(08:22,10.8KB,CSDN 7 条 RAG 演进 + AI Agent + MLOps)
- #1. 🔴 RAG 已死?2026 年最值得关注的 5 个下一代检索增强生成技术(德雷斯克罗萨,GitCode/AtomGit,2026-05-30)—— GraphRAG + MM-RAG + Hierarchical RAG + Adaptive RAG + RAFT 五技术对比表 + 完整代码块(4 个 LangChain 风格实现)+ 2026 成熟度评级
- #2. 🔴 收藏备用|2026版AI Agent Tool Use 机制全解析(kaka0722ww,CSDN,2026-04)—— 7 步机制解析(工具翻译→模型决策→参数生成→输出请求→程序执行→结果回传)
- #3. 🟠 2026 多 Agent 深度解析(jiangjunshow,CSDN,2026-06)—— 4 架构模式(编排式/群组式/流水线式/层级式)
- #4. 🟠 LLMOps 实战(weixin_29035147,CSDN,2026-06)—— 7 阶段生命周期(数据工程→训练管理→评估认证→部署路由→监控观测→安全对齐→合规审计)
- #5/#6/#7:低质量条目(折叠/付费/早期时间)
- 2026-06-28-morning-briefing-ai-agents-stack-owasp-grab-opencode-cognee.md(09:36,7.9KB,AI Agent 工程栈全景 + 编码 Agent 横向 + Grab 生产案例 + Cognee + OWASP)
- 1. 🔥 The AI Engineer - The AI Agents Stack (2026 Edition)(6 层架构,2024 Letta 演进 → 2026 已演进三层)—— 底层推理 / 中间记忆/工具/编排 / 上层安全/可观测/生产交付
- 2. 🔥 Grab 工程团队 AI Agent 落地案例(Bhavishya Pandit,引用 March 2026 Grab Engineering 官方博文)—— FastAPI + LangGraph 多 Agent 系统,每周挽回两个工作日
- 3. 🔥 OWASP Top 10 AI/LLM/Agents (2026 Cheat Sheet)(Alex Ewero,OWASP 贡献者)—— LLM01-LLM10 + ASI01-ASI10 + 语义防火墙缓解
- 4. 🟠 OpenCode 编码 Agent(opencode.ai + InfoQ)—— 160K stars,Anomaly 公司出品,provider-agnostic + 隐私优先
- 5. 🔥 Cognee 知识图谱 Agent 记忆平台(cognee.ai + GitHub)—— 3 年历史 + Python SDK 生产级 + 每月 100 万+ pipeline + 70+ 公司采用(含 Bayer)+ 6 阶段 pipeline + 14 种检索模式 + graph-vector 混合架构
- 6. 🟡 AI Engineer 角色分析(Alex Ewero)—— 1000+ 职位描述解读
- 7. 🟡 YouTube: You Are Not Ready: Agentic Coding in 2026(Jo Van Eyck,87K views)—— OpenClaw + Beads + Gas Town + Ralph
- 过滤:fundaai(投资视角)/ futureagi / aiagentssimplified / nickpotkalitsky / HuggingFace papers trending
- 2026-06-28-1050-engineering-filter-production-agent-inference-stack.md(10:53,21.6KB,生产 Agent 排障 SRE 工程 11 保留 + 1 条件)
- 1. Sean Goedecke Staff Engineer LLM Workflow 2026(seangoedecke.com)—— 80% bug 诊断准确率 + 14 次 agent session 复杂度
- 2. buildmvpfast Debugging AI Agents in Production(buildmvpfast.com)—— 50KB/span trace + 67.6% token 在 tool responses + 10GB+ trace data per session
- 3. Datadog State of AI Engineering 2026(datadoghq.com)—— 5% → 2% LLM call 错误率 + 840 万次 rate limit 错误(基于真实 trace,非问卷)
- 4. Anthropic Engineering Blog 2026 年 4-6 月(anthropic.com/engineering)—— Decoupling the Brain from the Hands / Claude Code auto mode / Harness design for long-running application development / Eval awareness in Claude Opus 4.6's BrowseComp performance / Quantifying infrastructure noise in agentic coding evals
- 5. MLflow Building Production-Ready AI Agents 2026(mlflow.org)—— SLO + Circuit Breaker + Deterministic Code 混用 + 插件安全
- 6. Arize AI Agent Debugging Four Lessons from Shipping Alyx(arize.com)—— Skills as Markdown Runbooks + jq 配方重构调用树
- 7. RAGPerf(arXiv 2603.10765v1)—— 端到端 RAG benchmarking framework + 模块化(Wikipedia 19.3 GB + Arxiv 48 GB + github-code 32 GB + Audio 35.5 GB)
- 8. AI Engineer Roadmap 13 Steps(dataskew.io)—— 0.prerequisites → 12.Portfolio,含 API key 安全规则
- 9. The Neural Maze AI Systems Engineer Journey(theneuralmaze.substack.com)—— Demo 成功 vs 真实用户失败 反模式 + IEEE-CAI 2026 Multimodal RAG 系统 + ReAct 框架
- 10. Simon Willison Weblog 6 月(simonwillison.net)—— Datasette Agent + Claude Fable 5 体验 + sqlite-utils 4.0 + GLM-5.2 评测
- 11. Addy Osmani My LLM Coding Workflow 2026(addyo.substack.com)—— Google Chrome 工程总监署名 + Specs before code 原则
- #12 YouTube OpenHand AI Agent Debugging(条件保留)
- 过滤:0 丢弃
- 2026-06-28-afternoon-briefing-inference-vectordb-k8s-substack.md(11:08,12.3KB,Vector DB 2026 选型 + 推理引擎三分天下 + K8s AI + 4 Substack + KV cache 6 arXiv)
- database · Vector DB 选型(多源对比):分层选型框架(pgvector < 100 万 / Qdrant 100 万~千万 / Milvus/Vespa 亿级 / Pinecone 企业级 / Weaviate 向量+文档 / Chroma 开发测试)+ Qdrant v1.18 TurboQuant + Milvus 3.0 zero-copy + Pinecone Builder $20/月 GA + ⚠️ pgvector CVE-2026-3172:7 天内升级生产 PG
- backend · 推理引擎三分天下:vLLM vs SGLang vs TRT-LLM H100 基准(SGLang +29% 优势 / NSA + TRT-LLM Blackwell 3-5x 加速 / vLLM MRV2 GB200 +56% / SGLang 新支持 Qwen3.5/Kimi-K2.5/GLM-5/M2.5 / vLLM GitHub Octoverse 第 1)
- cloud-native · K8s AI:66% 生成式 AI 推理工作负载跑在 K8s 上 / KServe 生产推理默认 / K8s 运行 AI Agent 安全缺口
- substack · 4 信源:① Nathan Benaich State of AI: May 2026(中国 4 实验室 12 天连续开源 GLM-5.1/M2.7/K2.6/V4 + Cognition $25B + Cursor $50B + Cohere+Aleph Alpha)② LLMs Research 每周论文精选(GLM 2021→2026 复盘 + 70B 模型 40% 浪费)③ AI Evaluation Digest 2026 June(SuperARC 算法信息论测试 + 对话轨迹替代模拟环境)④ Simon Willison LLM Predictions for 2026
- arxiv · KV Cache 6 arXiv:Predictive Multi-Tier Memory Management(2604.26968,7.4x batch + 47% 成本)+ MLRA(2603.02188,4-way TP)+ GQLA(2605.15250,硬件自适应)+ LRKV(2601.11471,MHA 45-53% cache)+ MHA2MLA-VLM(2601.11464,VLM 转 MLA)+ CCGQA(2510.04476,8x 压缩无性能下降)
- 2026-06-28-database-kv-cache-arxiv.md(11:09,8.3KB,KV cache 7 范式对比 + 6 arXiv 精读笔记 + ICDE 2026 数据库)
- 7 范式基线:MHA → MQA → GQA → MLA → LRKV → MLRA → GQLA → CCGQA(含 KV Cache 量级 + Compute 变化 + 主要缺点)
- 6 arXiv 精读:LRKV(128M~6.3B 模型,45-53% cache)+ Multi-Tier Memory(57x 内存过度配置 + 7.4x batch size + 47% 成本降低)+ MLRA(4-way TP 解码)+ GQLA(解决 MLA 架构锁定)+ MHA2MLA-VLM(VLM 转 MLA + Modality-decoupled 低秩近似)+ CCGQA(8x KV cache 压缩无性能下降)
- ICDE 2026 接收论文:FaScalSQL(GPU-Accelerated SQL Query Engine,NUDT 国防科技大学)+ LITHE(Query Rewrite Advisor using LLMs,IISc Bangalore)
- ACM 2026 Learned Query Optimizer 综述:Cardinality Estimation / Join Ordering / E2E Optimizer
- ⚠️ pgvector CVE-2026-3172 升级提示
- 🔴 紧急 + 🟡🟢 中低 6 项工程行动建议
- 2026-06-28-csdn-inference-finetuning-vllm-lora.md(12:21,7.9KB,CSDN 4 高 + 3 Tier-2 推理部署 + LoRA 排障)
- #1. 🔴 vLLM vs Ollama SLO 排障(DeepSeek 技术社区,2600_96123547,2026-06-08)—— P99 排队时间 40% 占比 + KV cache < 85% P99 指数增长 + int8 量化降 30% 延迟 + 成本模型
- #2. 🔴 LoRA 微调排障(CSDN AI 硬件创业社区,weixin_30667649,2026-06-07)—— transformers 4.36.2 + torch 2.1.0+cu118 + flash-attn CUDA 11.8 编译坑 + AWQ 量化 1.1GB / 2.3x 速度 / 0.8% 准确率下降
- #3. 🟠 2026 vLLM 部署(AtomGit,2026-05-20)—— Python 3.10 + CUDA 12.1(别用 Python 3.12 numba 兼容)+ vLLM 0.6.0+ 原生 function calling
- #4. 🔴 A10 GPU vLLM 调参 + Dify + WSL2 网络陷阱(AI Agent 技术社区,2026-06)—— A10 CUDA Graph 构建失败率 >60% + --enforce-eager + --max-num-seqs 临界点 128 + host.docker.internal WSL2 陷阱
- #5/#6/#7 Tier-2:RAG 2026 趋势(EnjoyEDU)/ LangChain 五大核心(综述)/ Ollama vs vLLM vs llama.cpp 选型(AMD 中国)
/shared/research-kb/inbox/flyp/(6-28 morning 共 1 份)
- 2026-06-28-morning-read-Jets-RMBench-critical-review.md(09:50,16.9KB,flyp 周日反方审稿 · Jets + RM-Bench 双稿)
- (A) Decomposing LLM Computation with Jets(ICLR 2026 poster,OpenReview id=u6JLh0BO5h)
- 核心贡献:Jet operator 截断 Taylor 级数泛化 + "ground and subsume Logit Lens" + 超指数路径结构 + n-gram sketch + 毒性 indexing + OLMo pretrain dynamics
- 评级 B+:理论★★★★ + 工程★★ + 证据★★ + 复现★
- 关键盲点:(super-)exponential 完整展开计算不可行 / 与 SAE / probing 对比缺位 / n-gram sketch 长程任务 fidelity 衰减 / toxicity indexing robustness
- 建议:入 notes/interpretability/method-school-comparison-2026.md(与 Anthropic circuits / SAE / cross-layer transcoder 对照)
- 审稿追问:截断阶数如何选 / n-gram sketch 长上下文 fidelity / 与 SAE 对比是否补 / 代码是否 release
- (B) RM-Bench: Benchmarking Reward Models with Subtlety and Style(NeurIPS 2024 Accept Oral,arXiv 2410.16184v1)
- 核心贡献:从"模型能力差异"转向"subtle content + style bias"评测维度 + 40 个 RM 评测 + SOTA 平均 46.6% < 随机 50%
- 评级 A-:评测范式★★★★ + 证据★★★★ + 公开★★★★ + 下游验证★★★
- 与 RewardBench 2(ICLR 2026)对照:RM-Bench 偏 RM 鲁棒性 / RewardBench 2 偏 RM 综合能力;两者都未公开具体相关系数(RM 评测领域方法论缺口)
- 建议:入 notes/post-training/rm-evaluation-2026.md(与 RewardBench 2 共建对照)
- 复现建议:用 Qwen2.5-RM / Llama-3.1-RM 在 H100 上跑一遍验证 46.6% 结论在 2026 RM 上是否仍成立
- 综合判断:Jets 需补 SAE 对比才升级;RM-Bench P1 入库;Jets + RM-Bench 在"评测与可解释性"上互补(mechanistic 路径 + behavioral 评测)
/shared/research-kb/inbox/stephen/(6-28 morning 共 7 份 0157 RSS 信源抓取 + 本文件)
- 2026-06-28-0157-news-anthropic-news.md(01:57,1.8KB,Anthropic / Claude 5 条)
- Anthropic Economic Index report: Cadences
- Introducing Claude Tag
- Mapping AI-enabled cyber threats: Insights from the LLM ATT&CK Navigator
- How Claude Code is used in practice
- ⚠️ Statement on the US government directive to suspend access to Fable 5 and Mythos 5(监管风险信号)
- 2026-06-28-0157-news-bens-bites.md(01:57,0.6KB,Ben's Bites 5 条)
- Claude Code in Slack + Record a skill(5.5-cyber vs mythos)+ The first big exit in AI + Bye bye Fable + New Claude model - Fable
- 2026-06-28-0157-news-deepmind-news.md(01:57,1.0KB,DeepMind 5 条)
- Introducing computer use in Gemini 3.5 Flash
- Unlocking UK house-building with AI-accelerated planning
- Securing the future of AI agents(AI Control Roadmap + 实时监控)
- DiffusionGemma: 4x faster text generation
- Investing in multi-agent AI safety research($10M 多 Agent 安全资金)
- 2026-06-28-0157-news-google-ai.md(01:57,1.5KB,Google AI 5 条)
- Google Finance June 2026 升级 + new Android app
- AMIE 疾病管理 Nature 论文(AMIE 匹配初级保健医师复杂疾病管理)
- Alabama $1.5B 数据中心投资(2026-2027)
- Virginia 社区投资 + 能效项目
- The latest AI news we announced in May 2026
- 2026-06-28-0157-news-hf-blog.md(01:57,0.7KB,HF Blog 5 条)
- Run a vLLM Server on HF Jobs in One Command
- Which tokens does a hybrid model predict better?(AllenAI)
- Accelerating Transformers Fine-Tuning with NVIDIA NeMo AutoModel
- Introducing the FFASR Leaderboard: Benchmarking ASR in the Real World
- Build real agentic apps using CUGA(IBM Research,two dozen working examples on a lightweight harness)
- 2026-06-28-0157-news-openai-news.md(01:57,1.4KB,OpenAI 5 条)
- 🔥 Previewing GPT-5.6 Sol: a next-generation model(更强 coding + science + cybersecurity + 最先进 safety stack)
- How agents are transforming work(OpenAI 研究论文,agents 支持更长更复杂任务)
- 🔥 OpenAI and Broadcom unveil LLM-optimized inference chip: Jalapeño(自研 AI 推理芯片,性能 + 效率 + 规模)
- Helping build shared standards for advanced AI(Appia Foundation)
- How GPT-5 helped immunologist Derya Unutmaz solve a 3-year-old mystery(T cell 行为 + 癌症 + 自身免疫研究)
- 2026-06-28-0157-news-tldr-ai.md(01:57,0.6KB,TLDR AI 5 条 6-22 至 6-26)
- 6-26 US vs. OpenAI / state of AI economy / scaling laws
- 6-25 Jalapeño chip / Anthropic accuses Alibaba / Gemini computer use
- 6-24 Claude Tag / Seedance 2.5 / Mistral OCR 4
- 6-23 SpaceX Colossus deal / GPT-5.5 Cyber launch / Codex as workspace
- 6-22 Orchestration models / DeepMind exodus / loop engineering
/shared/research-kb/inbox/spark/(草稿目录 6-28 仍 0 份新文件)
- 自 2026-06-10 后,spark 实例仍仅 2 份历史文件(agentic-rag-runtime-reliability.md + 6-27 1557-rss-gradient-flow.md RSS 抓取)
- 截至 2026-06-28 持续 18 天空档(比 6-27 morning 17 天再 +1 天,比 6-27 evening 16 天再 +2 天)
- cron review 通道已恢复 ✅(详见下方)
/shared/research-kb/review/(Spark cron 最新)
- 2026-06-28-1125-spark-24h-review.md(11:25,7.9KB)—— 输入 30 文件,详见 §6.1
- ⚠️ 与 6-27 23:25 上棒对比:cron review 通道已恢复正常(6-27 evening 棒提及"6-27 cron review 仍未生成"问题已解决)
/shared/research-kb/digests/(Spark cron 最新)
- 2026-06-28-1125-spark-24h-digest.md(11:25,2.5KB)—— 与 6-27 23:25 上棒对比已恢复 ✅
- ⚠️ digest 文件名 *-spark-24h-digest.md 仍为 Spark 命名,但 spark 实例草稿目录空档 18 天,命名与实际归属分离问题待 Anan 确认
2.2 本轮未发起新增外部检索
仅对 6-27 12:45 → 6-28 12:45 各实例已产出草稿做协调收口判断;本实例(Stephen)的「研究内容」由其他实例产出提供,本棒不参与 arXiv / Substack / CSDN 直接搜索。
3. 6-28 morning 高价值条目(按主轴)
3.1 🔥 KV Cache 压缩范式 2026 突破(jay 6-28 11:08 + 11:09 双稿 + Sebastian Raschka 呼应)
7 范式 + 6 arXiv + Sebastian Raschka 同步:
| 范式 | 代表 | KV Cache 量级 | 主要贡献 | 来源 |
|---|---|---|---|---|
| MHA | 标准多头注意力 | O(n·h·dh) | 基线 | - |
| MQA | Shazeer 2019 | 共享单一 K/V | 解码快但质量损失 | - |
| GQA | Ainslie 2023 | 每组共享 K/V | 精度 vs 压缩 trade-off | - |
| MLA | DeepSeek 2024 | 低秩联合压缩 ~4.5×dh | RoPE 冲突;锁死 MQA-absorb 路径 | - |
| 🟠 LRKV | arXiv 2601.11471 | MHA 的 45-53% | 共享 KV projection + 低秩 head-specific residual | jay 11:09 |
| 🔴 Multi-Tier Memory | arXiv 2604.26968 | 架构感知 sizing engine → 7.4x batch size + 47% 成本降低 | 解决 MLA 57x 内存过度配置 + KV cache 多层存储(GPU HBM/CPU DRAM/CXL/NVMe/RDMA) | jay 11:09 |
| 🟠 MLRA | arXiv 2603.02188 | 可分区块 | 4-way TP 解码(MLA 单一 MQA-absorb 路径破解) | jay 11:09 |
| 🟠 GQLA | arXiv 2605.15250 | MLA 级 | 硬件自适应分组查询(解决 MLA 架构锁定) | jay 11:09 |
| 🟠 MHA2MLA-VLM | arXiv 2601.11464 | MHA → MLA | Modality-adaptive partial-RoPE + Modality-decoupled 低秩近似 | jay 11:09 |
| 🟠 CCGQA | arXiv 2510.04476 | 8x 压缩无性能下降 | compute + bandwidth 联合优化(Q 也 down-projection) | jay 11:09 |
| 呼应 1 | Sebastian Raschka | Recent Developments in LLM Architectures: KV Sharing, mHC, Compressed Attention(Gemma 4 → DeepSeek V4 长上下文成本降低) | jay 0053 RSS |
关键交叉印证: - MLA → MLRA / GQLA / MHA2MLA-VLM 是 MLA 的三方向升级: - MLRA:破解 MLA 单一 MQA-absorb 解码路径 → 支持 4-way TP 并行解码 - GQLA:保留 MLA 压缩率 + 支持 GQA 风格分组 → 硬件自适应 - MHA2MLA-VLM:MLA 迁移到 VLM,适配多模态场景 - CCGQA:compute + bandwidth 联合压缩 —— GQA/MLA 只压缩 memory,CCGQA 把 Q 也 down-projection → 实现"8x 压缩无性能下降" - LRKV:第一篇在压缩率下精度超越 MLA 的工作(128M~6.3B 模型,test loss 低于 MHA/MQA/GQA/MLA) - Multi-Tier Memory:内存过度配置问题首次系统化量化(MLA 架构在通用框架下 57x 浪费;7.4x batch size 提升 + 47% 成本降低) - Sebastian Raschka 同步:LLM Architectures 演进趋势与 arXiv 双稿完美互证 —— "From Gemma 4 to DeepSeek V4, How New Open-Weight LLMs Are Reducing Long-Context Costs"
关键风险(flyp 反方审稿类似框架可借鉴): 1. LRKV:跨模型(Llama / Qwen / Pythia)未验证;pretrain dynamics 跨模型一致性 2. Multi-Tier Memory:57x 内存过度配置 + 7.4x batch size 数字"分析推算"非实测,待论文正式版验证 3. MLRA:4-way TP 解码路径在生产分布式推理引擎(SGLang / vLLM)的实际收益 4. GQLA:硬件自适应"自适应"到什么程度?是否需要重新训练? 5. MHA2MLA-VLM:modality-decoupled 在视觉 / 文本混合任务上的 fidelity 衰减 6. CCGQA:8x 无性能下降的 claim 主要在小模型(<7B)测试,需更大模型验证
建议主题页:notes/kv-cache/compression-paradigms-2026.md(立项条件具备 —— 7 范式 + 6 arXiv + Sebastian Raschka 同步 + jay 6-28 1050 RAGPerf benchmark 印证)
3.2 🔥 推理引擎三分天下 vLLM/SGLang/TRT-LLM(jay 6-28 11:08)
vLLM/SGLang/TRT-LLM 三维对比:
| 维度 | vLLM | SGLang | TRT-LLM |
|---|---|---|---|
| 核心机制 | PagedAttention + Python-first | RadixAttention + 结构化生成运行时 | 编译引擎路径 |
| H100 吞吐 | 12,500 tokens/sec | 16,200 tokens/sec(+29%) | 最高原始吞吐 |
| 前缀缓存 / RAG | 中等 | 6.4x(prefix-heavy 工作负载) | 不适用 |
| MoE 调度 | 一般 | RadixAttention 多 call 调度优 | 中等 |
| DeepSeek 模型 | 支持 | 官方推荐,EAGLE 投机解码 1.8x | 支持 |
| Blackwell | MRV2 + DSA kernel 3-5x | NSA + TRT-LLM decode backend | 原生 |
| 部署复杂度 | 低 | 中 | 高(需编译) |
| 适用场景 | 动态批处理、多样请求 | 长输出、多轮对话、RAG | NVIDIA 硬件最高吞吐 |
SGLang vs vLLM 2026 年 6 月结论: - 部署 DeepSeek 全系 → SGLang(官方推荐) - 前缀重复多的 RAG / Agent 多轮 → SGLang(29% 优势) - 单轮 unique prompt 大批量 → vLLM 可与之匹敌 - 追求最高原始吞吐 + 可接受工程复杂度 → TRT-LLM
SGLang 新模型支持(2026年6月):Qwen3.5、Kimi-K2.5、GLM-5、MiniMax 2.5
GitHub Octoverse 2025 数据点:vLLM 是 GitHub 第 1 大 AI 开源项目(按活跃度)
AMultiple 2026 年 4 月对比:Llama 3.1 8B batch inference H100,C++ 原生架构(SGLang / LMDeploy)比 vLLM(FlashInfer 优化)额外释放 29% 吞吐
建议主题页:notes/inference-engineering/selection-2026.md(6-27 morning 立项条件具备 → 6-28 morning 加 SGLang NSA + TRT-LLM Blackwell 3-5x 加速 + SGLang +29% 优势 → 立项推进)
3.3 🔥 Vector DB 2026 选型 + ⚠️ pgvector CVE(jay 6-28 11:08)
Vector DB 分层选型决策框架:
| 场景 | 推荐方案 | 理由 |
|---|---|---|
| 中小规模(< 100万向量)+ 已有 PG | pgvector | 内置集成,无单独服务,百万级无需特调 |
| 中等规模(100万~千万级) | Qdrant | Rust 实现,850 QPS @ p95~8ms,过滤搜索强 |
| 大规模(亿级以上)+ 低延迟 | Milvus / Vespa | K8s 原生分布式,Milvus 3.0 zero-copy 数据湖查询 |
| 完全托管 / 企业级 | Pinecone | sub-20ms p95,但成本是 PG 的 3-8x |
| 向量 + 文档统一查询 | Weaviate(混合+GraphQL)或 MongoDB Atlas Vector Search | 已用 MongoDB 时优先 |
| 开发测试 / 轻量 | Chroma | DX 最佳,不适合生产 |
2026 关键版本更新: - Qdrant v1.18(2026年5月):TurboQuant 量化 + dynamic named vectors + io_uring 优化 - Milvus v3.0.0-beta(2026年5月):zero-copy 数据湖查询,v2.6.16 GA 稳定 - Pinecone(2026年5月):Builder tier $20/月 GA,Nexus knowledge engine 预览,Singapore + Frankfurt 区域 GA
⚠️ pgvector CVE-2026-3172(紧急): - 跨 relation 数据泄露风险 - PostgreSQL 生产环境需在 7 天内升级 - 来源:RankSquire Vector DB News May 2026 - 可信度:★★★★★(CVE 编号明确,来源可查)
建议主题页:notes/database/vector-db-selection-2026.md(6-26 evening 立项条件具备 → 6-28 加分层选型框架 + 3 主流引擎版本更新 + pgvector CVE 紧急升级 → 立项推进 + ⚠️ 生产 PG 7 天内升级)
3.4 🔥 Substack 高质量研究信源爆发(jay 6-28 单日净增 11 条 + 累计 14+ 条)
jay 6-28 单日净增 11 条 Substack:
| # | Substack / Newsletter | 主题 | 评级 |
|---|---|---|---|
| 1 | The AI Engineer - The AI Agents Stack (2026 Edition) | 6 层 AI Agent 工程架构 | 🔴 |
| 2 | Bhavishya Pandit - How Grab Uses AI Agents | Grab + LangGraph 生产案例 | 🔴 |
| 3 | Alex Ewero - OWASP Top 10 AI/LLM/Agents (2026) | ASI 速查表 | 🔴 |
| 4 | OpenCode / InfoQ | 160K stars 编码 Agent | 🟠 |
| 5 | Cognee 官方博客 | graph-vector 混合记忆平台 | 🔴 |
| 6 | Alex Ewero - 1,000+ Job Descriptions | AI Engineer 角色分析 | 🟡 |
| 7 | Jo Van Eyck YouTube (via jay 0053 关联) | Agentic Coding in 2026 | 🟡 |
| 8 | Nathan Benaich - State of AI: May 2026 | 中国 4 实验室 12 天连续开源 GLM-5.1/M2.7/K2.6/V4 | 🔴 |
| 9 | LLMs Research - 每周论文精选 | GLM 2021→2026 复盘 + 70B 模型 40% 浪费 | 🟠 |
| 10 | AI Evaluation Digest - 2026 June | SuperARC + 对话轨迹替代模拟环境 | 🟠 |
| 11 | Simon Willison - LLM predictions for 2026 | 1 年/3 年/6 年 LLM 编码预测 | 🟡 |
关键发现: - 单日 11 条 Substack 净增创历史新高(6-27 morning 净增 5 条;6-26 evening 净增 1 条 micheallanham CMA) - Nathan Benaich State of AI: May 2026 是 6-28 最高价值 Substack:中国开源模型集中爆发是重大事件(Cohere+Aleph Alpha 主权 AI 并购也是) - OWASP Top 10 完整版 + Grab 生产案例 + Cognee graph-vector 混合架构 —— 三位一体构成 AI Agent 安全 + 生产 + 记忆的完整坐标系 - The AI Engineer AI Agents Stack (2026 Edition) —— 与 jay 6-27 0937 + 6-28 1050 #9 Neural Maze 完美呼应 - 累计 Substack 信源:jay 6-26 + 6-27 + 6-28 累计净增 约 18 条(6-26: 1 micheallanham CMA;6-27 morning: 5 The Neural Maze / Jam with AI ×2 / AI with Aish / ByteByteGo + 1 Fountain City = 6;6-28 morning: 7 + 4 = 11)
建议主题页:notes/substack/high-quality-sources-2026.md(立项条件具备 —— 累计 18+ 条 Substack + 9 条高质量(🔴)+ 主题群完整:AI 工程 / 安全 / RAG / 推理 / 评测 / 编码 Agent)
3.5 🔥 行业头部大新闻(stephen 0157 RSS 7 信源整合)
OpenAI 2026-06 重大发布: - 🔴 Previewing GPT-5.6 Sol —— next-generation 模型,更强 coding + science + cybersecurity + 最先进 safety stack - 🔴 OpenAI + Broadcom Jalapeño inference chip —— 自研 AI 推理芯片,性能 + 效率 + 规模 - 🟠 How agents are transforming work —— OpenAI 研究论文,agents 支持更长更复杂任务 - 🟠 Appia Foundation 共享标准 - 🟡 GPT-5 Pro 帮免疫学家 Derya Unutmaz 解 3 年 T cell 之谜
Anthropic 2026-06 重大发布 + 监管信号: - Anthropic Economic Index report: Cadences - Claude Tag(对话管理) - LLM ATT&CK Navigator(AI 网络威胁映射) - How Claude Code is used in practice - ⚠️ Statement on the US government directive to suspend access to Fable 5 and Mythos 5 —— 监管风险信号
DeepMind 2026-06 重大发布: - 🟠 Gemini 3.5 Flash computer use - 🟠 DiffusionGemma: 4x faster text generation - 🔴 $10M 多 Agent 安全资金(与 OpenAI Appia Foundation 共享标准互证) - AI Control Roadmap(内部系统安全 + 实时监控)
Google AI 2026-06 重大发布: - 🔴 AMIE 疾病管理 Nature 论文(AMIE 匹配初级保健医师复杂疾病管理) - Google Finance 新 Android app - Alabama $1.5B 数据中心投资(2026-2027)
HF Blog 2026-06 重大发布: - vLLM Jobs(一键启动) - AllenAI hybrid token prediction - NVIDIA NeMo AutoModel - FFASR Leaderboard - IBM Research CUGA(two dozen working examples on a lightweight harness)
建议主题页:
- notes/industry/2026-mid-flagship-releases.md(OpenAI / Anthropic / DeepMind / Google AI / HF 5 大厂商旗舰发布对比)
- notes/industry/inference-chip-landscape-2026.md(OpenAI + Broadcom Jalapeño 自研推理芯片 + Anthropic + Google 内部推理基础设施对比)
特别跟进事项: - ⚠️ Anthropic Fable 5 / Mythos 5 被美政府暂停 —— 监管风险信号,建议后续跟踪 Ben's Bites "Bye bye Fable" + "Record a skill" + "New Claude model - Fable" 主题 - ⚠️ TLDR AI 6-25 Anthropic accuses Alibaba —— 知识产权 / 监管国际维度
3.6 🔥 flyp 周日反方审稿 · Jets + RM-Bench(flyp 6-28 09:50)
(A) Jets(ICLR 2026 poster):
- 评级 B+:理论★★★★ + 工程★★ + 证据★★ + 复现★
- 核心盲点:超指数完整展开计算不可行 / 与 SAE / probing 对比缺位 / n-gram sketch 长程任务 fidelity 衰减 / toxicity indexing robustness
- 建议主题页:notes/interpretability/method-school-comparison-2026.md
- 后续:等 v2 / camera-ready 补 SAE 对比
(B) RM-Bench(NeurIPS 2024 Accept Oral):
- 评级 A-:评测范式★★★★ + 证据★★★★ + 公开★★★★ + 下游验证★★★
- 核心发现:SOTA 平均 46.6% < 随机 50%
- 与 RewardBench 2(ICLR 2026)对照:RM-Bench 偏 RM 鲁棒性 / RewardBench 2 偏 RM 综合能力
- 建议主题页:notes/post-training/rm-evaluation-2026.md
- 复现建议:用 Qwen2.5-RM / Llama-3.1-RM 在 H100 上跑一遍验证 46.6% 结论在 2026 RM 上是否仍成立
综合判断:Jets 与 RM-Bench 在"评测与可解释性"上互补 —— Jets 是 mechanistic 路径,RM-Bench 是 behavioral 评测 —— 是 2026 interpretability 的两条主流路线
6-27 evening 棒 MIRROR 位置未兑现:flyp 6-27 weekly notes §0 留 MIRROR(arXiv 2606.26793)位置,但 flyp 6-28 早读选 Jets + RM-Bench;MIRROR 留待 6-29 周一
建议主题页:
- notes/interpretability/method-school-comparison-2026.md(与 Anthropic circuits / SAE / cross-layer transcoder 对照)
- notes/post-training/rm-evaluation-2026.md(与 RewardBench 2 共建)
3.7 🔥 生产 Agent 排障 SRE 工程(jay 6-28 1050)
11 保留条目覆盖 4 维度:
| 维度 | 代表条目 | 关键数据 |
|---|---|---|
| 生产遥测 | Datadog State of AI Engineering 2026 | 5% → 2% 错误率 + 840 万次 rate limit 错误(真实 trace) |
| Trace 数据特征 | buildmvpfast Debugging AI Agents in Production | 50KB/span + 67.6% token 在 tool responses + 10GB+ trace per session |
| 官方工程实践 | Anthropic Engineering Blog 2026-04~06 | Decoupling the Brain from the Hands / Claude Code auto mode / Harness design / Eval awareness in Claude Opus 4.6 / Quantifying infrastructure noise in agentic coding evals |
| 架构设计原则 | MLflow Building Production-Ready AI Agents 2026 | SLO + Circuit Breaker + Deterministic Code 混用 + 插件安全边界 |
| 调试工作流 | Arize AI Agent Debugging Four Lessons | Skills as Markdown Runbooks + jq 配方重构调用树 |
| 多模态 RAG 基准 | RAGPerf(arXiv 2603.10765v1) | Wikipedia 19.3GB + Arxiv 48GB + github-code 32GB + Audio 35.5GB |
| 学习路线 | dataskew AI Engineer Roadmap 13 Steps | 0.prerequisites → 12.Portfolio + API key 安全规则 |
| 真实工程经验 | Sean Goedecke Staff Engineer LLM Workflow | 80% bug 诊断准确率 + 14 次 agent session 复杂度 |
| RAG 工程反模式 | The Neural Maze - AI Systems Engineer Journey | Demo 成功 vs 真实用户失败 + IEEE-CAI 2026 Multimodal RAG 系统 |
| 工具实测 | Simon Willison Weblog 6 月 | Datasette Agent + Claude Fable 5 + sqlite-utils 4.0 + GLM-5.2 评测 |
| AI 协作原则 | Addy Osmani My LLM Coding Workflow | Specs before code + AI 辅助 ≠ AI 自动化 |
建议主题页:notes/agent-engineering/production-sre-2026.md(立项条件具备 —— 11 保留条目覆盖 4 维度 + 跨 6 个权威来源:Datadog / Anthropic / MLflow / Arize / buildmvpfast / Sean Goedecke + 1 Substack + 1 学术 RAG benchmark)
3.8 🔥 AI Agent 工程栈全景 + Grab 生产案例(jay 6-28 morning brief)
The AI Engineer - AI Agents Stack (2026 Edition) 6 层架构: - 2024 Letta AI agents stack diagram → 2026 演进为 6 层 - 至少三层在 2024 年尚不存在独立类别 - 底层:推理引擎 - 中间:记忆 / 工具 / 编排 - 上层:安全 / 可观测 / 生产交付
Grab + LangGraph 多 Agent 生产案例(Bhavishya Pandit,引用 March 2026 Grab Engineering 官方博文): - FastAPI + LangGraph 多 Agent 系统 - 自动化重复数据调查 - 数据团队每周挽回两个工作日 - 含多 Agent 编排 + 优化 + 计费 + 信任机制全链路
OWASP Top 10 ASI 完整版(Alex Ewero): - LLM01-LLM10(OWASP Top 10 LLM)+ ASI01-ASI10(OWASP Top 10 Agents) - 指令(系统提示+函数调用)与数据(用户输入+RAG 文档)被拼接为单一字符串是核心风险源 - 缓解:语义防火墙 + 最小权限原则
OpenCode 编码 Agent: - 160K stars,Anomaly 公司出品 - Provider-agnostic + 隐私优先(不存储代码和上下文) - 支持本地部署 - 竞品:Codex(综合最佳)/ Claude Code(终端)/ Gemini CLI(免费长上下文)/ Cursor(IDE)/ OpenCode(开源灵活)
Cognee 知识图谱 Agent 记忆平台: - 3 年历史 + Python SDK 生产级 - 每月 100 万+ pipeline,70+ 公司采用(含 Bayer) - 6 阶段 pipeline(分类 → 权限检查 → 分块 → LLM 提取实体关系 → 摘要 → 向量+图并存) - 14 种检索模式 + graph-vector 混合架构 - 关键洞察:AI agent 记忆有三种形态(短期记忆 / 长期记忆 / 长期知识),传统 RAG 只能解决"记忆",解决不了"知识"
建议主题页:
- notes/agent-stack/architecture-landscape-2026.md(6 层架构 + Grab + LangGraph + OpenCode + Cognee 整合)
- notes/agent-security/owasp-asi-2026.md(OWASP Top 10 LLM + ASI + 语义防火墙)
3.9 🟠 CSDN 高价值继续强劲(jay 6-28 上午 7 + 下午 7 = 14 条)
上午 7 条(2026-06-28-csdn-rag-agent-mlops.md):
- 🔴 #1 RAG 已死?2026 年最值得关注的 5 个下一代检索增强生成技术(GraphRAG + MM-RAG + Hierarchical RAG + Adaptive RAG + RAFT)
- 🔴 #2 2026版AI Agent Tool Use 机制全解析(7 步机制)
- 🟠 #3 2026 多 Agent 深度解析(4 架构模式)
- 🟠 #4 LLMOps 实战(7 阶段生命周期)
下午 7 条(2026-06-28-csdn-inference-finetuning-vllm-lora.md):
- 🔴 #1 vLLM vs Ollama SLO 排障(P99 排队时间 40% 占比 + KV cache < 85% P99 指数增长 + int8 量化降 30% 延迟)
- 🔴 #2 LoRA 微调排障(transformers 4.36.2 + torch 2.1.0+cu118 + flash-attn CUDA 11.8 编译坑 + AWQ 1.1GB / 2.3x 速度 / 0.8% 准确率下降)
- 🟠 #3 2026 vLLM 部署(Python 3.10 + CUDA 12.1 + vLLM 0.6.0+ function calling)
- 🔴 #4 A10 GPU vLLM 调参 + Dify + WSL2 网络陷阱(A10 CUDA Graph 失败率 >60% + --enforce-eager + --max-num-seqs 临界点 128 + host.docker.internal WSL2 陷阱)
与 6-27 morning CSDN 对比:6-27 morning 19 条 CSDN(0820 12 + 1221 7)→ 6-28 morning 14 条(0822 7 + 1221 7)—— 单日 CSDN 数量稳定,单实例占比仍 ≥ 80%
CSDN 单实例占比统计(累计): - 6-10:jay 10 份 - 6-11:jay 9 份 - 6-12:jay 8 份 - 6-13:jay 11 份 - 6-14:jay 7 份 - 6-15:jay 13 份 - 6-16:jay 12 份 - 6-17:jay 8 份 - 6-18:jay 7 份 - 6-19:jay 6 份 - 6-20:jay 7 份 - 6-21:jay 7 份 - 6-22:jay 7 份 - 6-23:jay 7 份 - 6-24:jay 8 份 - 6-25:jay 9 份 - 6-26:jay 8 份 - 6-27:jay 19 份 - 6-28:jay 14 份(截至 12:45) - 总计:约 177 条 CSDN 草稿,jay 占比 100% —— CSDN 单实例占比 100%(无替代)
3.10 🟠 tom 周日轻量雷达(tom 6-28 08:40)
4 高价值 + 4 候选 + 0 Substack:
🔴 高价值 4: - MemStrata(arXiv 2606.26511)—— 5 天内 tom 雷达第 3 次出现(6-26 + 6-27 + 6-28 morning) - GauntletBench(arXiv 2606.14397)—— 时间感知/图形理解/跨维度泛化三大能力 - Progress Advantage(arXiv 2606.26080)—— RL post-training 隐含 step-level 评分信号 - CoffeeBench(arXiv 2606.16613)—— 多智能体经济系统
🟠 候选 4: - 多模型路由/投票/级联系统的失败上限(arXiv 2606.27288,67 frontier models,beta = all-models-wrong rate) - PhysRAG(arXiv 2606.26916)/ LISA(arXiv 2606.27192)/ ABACUS(arXiv 2606.23835)
⚠️ Substack 缺口:本次 0 条(与 6-27 1 条 Fountain City 对比)—— tom 周日 radar Substack 信源不足
去重参考:查看近 7 天 inbox 文件(06-21 至 06-27),本期 MemStrata、GauntletBench、Progress Advantage、CoffeeBench 均为新条目(除 MemStrata 5 天内第 3 次)
3.11 🟠 HF Daily 6-28 高票 + 新主题浮现
#1 主题延续:Are We Ready For An Agent-Native Memory System? 104▲(6-26 102▲ → 6-27 102▲ → 6-28 104▲,HF 社区连续 3 天同主题)
🟠 新主题浮现:3D / 世界模型 / 机器人控制: - #4 In-Context World Modeling for Robotic Control 42▲ - #10 MVTrack4Gen: Multi-View Point Tracking as Geometric Supervision for 4D Video Generation 34▲ - #15 Fast LeWorldModel 22▲
关键发现: - 与 jay 6-28 11:09 ICDE 2026 / Cool Papers cs.IR 形成呼应(NOVA + UniFormer 等推荐系统架构演进) - 本周 3D / NeRF / 世界模型 主题从 6-26 evening 棒 §6.1 缺口到 6-28 morning 已开始填补 - 建议 flyp 6-28 evening 或 6-29 早读跟进
3.12 🟡 Sebastian Raschka + ByteByteGo + Cool Papers RSS(jay 6-28 0053)
Sebastian Raschka 5 条(与 jay KV cache 双稿完美呼应): - 🔥 Recent Developments in LLM Architectures: KV Sharing, mHC, Compressed Attention(Gemma 4 → DeepSeek V4 长上下文成本降低) - Using Local Coding Agents / LLM Research Papers: 2026 List (Jan-May) / Workflow for Understanding LLM Architectures / Components of A Coding Agent
ByteByteGo 5 条(与 jay RAG + 工程实践呼应): - 🔥 EP220: RAG vs Graph RAG vs Agentic RAG - 🔥 An Ex-Meta L8's Agentic Engineering Setup - Top Anti-Patterns / Large vs Small LLMs / AI-Native Leaders Organizational Playbook
Cool Papers cs.CL + cs.IR 10 条: - 🔥 NOVA: Verification-Aware Agent Harness for Architecture Evolution in Industrial Recommender Systems(arXiv 2606.27243,与 jay 1050 工程排障 + Anthropic Harness design 呼应) - Empowering GUI Agents / Multilingual Reasoning Cascades / TRUST: Item-Calibrated / UniFormer / TriPAH: Cross-Modal Medical Retrieval / IPTC Topic Space 等
建议主题页:
- notes/oss-architectures/agent-harness-2026.md(Anthropic Harness design + Arize Skills + NOVA 三方印证)
- notes/rag/three-paradigms-2026.md(RAG vs GraphRAG vs Agentic RAG 三角对比)
3.13 🟡 Stephen 6-28 7 信源 RSS 抓取评估
首次覆盖 7 信源(Anthropic / Ben's Bites / DeepMind / HF Blog / OpenAI / Google AI / TLDR AI):
| 信源 | 抓取数 | 高价值条目 | 评级 |
|---|---|---|---|
| OpenAI | 5 | GPT-5.6 Sol + Jalapeño + How agents are transforming work + Appia + Derya Unutmaz | 🔴🔴🟠🟠🟡 |
| Anthropic | 5 | Economic Index + Claude Tag + ATT&CK Navigator + Claude Code + Fable/Mythos 暂停 | 🟠🟠🟠🟠⚠️ |
| DeepMind | 5 | Gemini 3.5 Flash computer use + DiffusionGemma + $10M Agent Safety + AI Control Roadmap + UK house-building | 🟠🟠🔴🟠🟡 |
| HF Blog | 5 | vLLM Jobs + AllenAI hybrid + NVIDIA NeMo + FFASR + IBM CUGA | 🟠🟡🟠🟡🟠 |
| Google AI | 5 | Google Finance + AMIE Nature + Alabama $1.5B + Virginia + May 2026 AI updates | 🟡🔴🟡🟡🟡 |
| Ben's Bites | 5 | Claude Code in Slack + Record a skill + First big exit + Bye bye Fable + New Claude Fable | 🟡🟡🟡🟡🟡 |
| TLDR AI | 5 | 6-22 至 6-26 行业事件速览 | 🟡🟡🟡🟡🟡 |
核心发现: - OpenAI 6-28 集中爆发:GPT-5.6 Sol 预览 + Jalapeño 自研芯片 + agents 论文 —— 3 项核心发布 - Anthropic Fable 5 / Mythos 5 美政府暂停 —— 监管风险信号 - DeepMind $10M 多 Agent 安全资金 —— 与 OpenAI Appia Foundation 共享标准互证 - Google AMIE Nature 论文 —— 医疗 AI 重要里程碑
后续行动: - ✅ 7 信源 RSS 抓取已正常运行(首次覆盖) - 🔄 建议 6-28 evening 棒前确认是否需要 RSS 抓取频率提升或扩展其他信源(如 Hugging Face papers、Simon Willison 完整 RSS)
4. 6-28 morning 分类覆盖度检查
| 分类 | 6-28 morning 覆盖 | 覆盖度 | 缺口与建议 |
|---|---|---|---|
| agent | 极强(tom 4🔴 + jay morning brief 7 Substack + jay 1050 11 保留 + flyp Jets/RM-Bench 双稿 + Stephen 7 RSS OpenAI/Anthropic/DeepMind) | ✅ 100% | 缺口:agent-to-agent 通信协议(A2A/ANP)仍无实例跟踪;建议 jay 6-28 evening 跟进 |
| rag | 极强(tom 4🔴 + jay 0822 #1/#2 GraphRAG/MM-RAG/Hierarchical/Adaptive/RAFT + jay 1050 #9 Neural Maze + jay afternoon 4 Substack + flyp MIRROR 留位置 + ByteByteGo EP220 + jay 6-27 1221 RAG 五代 + Cool Papers cs.IR) | ✅ 100% | 缺口:无;RAG 范式已饱和 |
| multimodal | 强(tom PhysRAG + LISA + ABACUS + HF Daily #4 In-Context World Modeling + #10 MVTrack4Gen + Sebastian Raschka KV Compressed Attention + jay 1050 RAGPerf) | ✅ 90% | 缺口:3D / NeRF / 世界模型 本周已浮现(HF Daily 6-28 #4 #10 #15 + Sebastian Raschka);建议 flyp 6-28 evening 或 6-29 早读跟进 |
| systems | 极强(tom #4 CoffeeBench 多智能体经济系统 + jay 1050 #3 Datadog + jay 1050 #4 Anthropic + jay 1050 #5 MLflow + jay 1050 #6 Arize + jay afternoon K8s AI + Vector DB + KV cache + Stephen OpenAI Jalapeño 自研芯片) | ✅ 100% | 无缺口 |
| engineering | 极强(jay 1050 11 保留 + jay 0822 #4 LLMOps + jay 1221 4 高 Tier-1 + Sean Goedecke + Addy Osmani + Datadog + Anthropic Engineering + MLflow + Arize + RAGPerf + ByteByteGo An Ex-Meta L8's Setup) | ✅ 100% | 无缺口 |
| csdn | 强(jay 0822 7 + jay 1221 7 = 14 条,jay 单 morning 已 14 条 + 上 morning 累计 33 条 CSDN) | ✅ 100% | 缺口:无;但 jay CSDN 单实例占比 100%(无替代) ⚠️ |
| database | 极强(jay 11:08 Vector DB 分层选型框架 + Qdrant/Milvus/Pinecone 版本更新 + ⚠️ pgvector CVE-2026-3172 + ICDE 2026 接收论文 + ACM 2026 Learned Query Optimizer + Cool Papers cs.IR) | ✅ 100% | 缺口:无;Vector DB 主题已立项条件具备 |
| risk | 强(OWASP Top 10 ASI + Datadog 5%→2% 错误率 + buildmvpfast 50KB/span + MLflow 插件安全 + MLflow 语义防火墙 + Anthropic Claude Tag + DeepMind $10M 安全资金 + ⚠️ Anthropic Fable/Mythos 美政府暂停) | ✅ 95% | 缺口:供应链 / 模型后门 / 数据投毒仍无专门条目;建议 tom 6-28 evening 跟进 |
| substack | 极强(jay 单日净增 11 条 Substack + 累计 18+ 条) | ✅ 100% | 建议立项:notes/substack/high-quality-sources-2026.md(条件具备) |
| other | 极强(Stephen 7 信源 RSS 抓取首次覆盖 + OpenAI 5 + Anthropic 5 + DeepMind 5 + HF Blog 5 + Google AI 5 + Ben's Bites 5 + TLDR AI 5 = 35 条行业新闻) | ✅ 100% | 建议立项:notes/industry/2026-mid-flagship-releases.md(OpenAI/Anthropic/DeepMind/Google/HF 5 大厂商旗舰发布对比) |
关键发现:
- Substack 单日 11 条净增创历史新高:jay 6-28 单日净增 11 条 + 累计 18+ 条;建议立项 notes/substack/high-quality-sources-2026.md
- CSDN 单实例占比 100%:jay 6-28 morning 14 条 + 6-27 morning 19 条 + 累计 177 条 CSDN 草稿 100% 由 jay 产出;Anan 应评估是否启动 spark / tom 的 CSDN 检索任务
- HF Daily #1 Agent-Native Memory 连续 3 天同主题:104▲ + 102▲ + 102▲,HF 社区已把"Agent 记忆工程"作为独立议题;与 MemStrata + SmartVector + CMA + ConvMemory v3 + Agent-Native Memory + Fountain City 形成完整主题群
- 行业头部大新闻:stephen 7 信源 RSS 抓取首次覆盖完整运行;OpenAI 6-28 集中爆发(GPT-5.6 Sol + Jalapeño + agents 论文)
- 监管风险信号:Anthropic Fable 5 / Mythos 5 被美政府暂停 + TLDR AI 6-25 Anthropic accuses Alibaba —— 监管国际维度需要后续跟踪
5. 跨实例冲突与去重
5.1 MemStrata 多源重复(已去重 ✅)
- tom 6-26 evening #1(首次出现)+ tom 6-27 morning #1 + tom 6-28 morning #1(5 天内第 3 次)+ flyp 6-27 10:35 weekly notes (A) 精读 + flyp 6-27 10:36 weekly reviews (A) 反方审稿
- 去重策略:tom 提供信号源(5 天内 3 次)/ flyp 提供深度精读 + 反方审稿;不重复精选,仅在主题页
notes/rag/paradigm-migration-2026.md统一汇聚 - 6-28 morning 跟踪:仍为 🔴 高价值,结构性问题持续被关注
5.2 KV Cache 优化多源印证(建议主题页立项)
- jay 6-28 afternoon 6 arXiv(2604.26968 + 2603.02188 + 2605.15250 + 2601.11471 + 2601.11464 + 2510.04476)+ jay 6-28 11:09 6 arXiv(重复部分)+ jay 6-28 1109 7 范式对比 + Sebastian Raschka Recent Developments in LLM Architectures: KV Sharing, mHC, Compressed Attention
- 去重策略:jay 11:08 + 11:09 双稿已部分重复(6 篇 arXiv 完全相同);建议主题页
notes/kv-cache/compression-paradigms-2026.md立项,按"MHA/MQA/GQA 基线 → MLA → 2026 升级(LRKV/MLRA/GQLA/MHA2MLA-VLM/CCGQA)→ Multi-Tier Memory 系统层"五维度结构
5.3 vLLM/SGLang 推理选型多源重复(建议主题页立项)
- jay 6-26 evening + 6-27 1050 + 6-28 上午 0822 工程排障 + 6-28 11:08 三分天下
- 去重策略:立项
notes/inference-engineering/selection-2026.md,6-28 morning 加 SGLang NSA + TRT-LLM Blackwell 3-5x 加速 + SGLang +29% 优势 + vLLM MRV2 GB200 +56% + SGLang 新支持 Qwen3.5/Kimi-K2.5/GLM-5/M2.5 + GitHub Octoverse #1
5.4 Vector DB 选型 + ⚠️ pgvector CVE 多源重复(建议主题页立项 + 紧急升级)
- jay 6-26 evening + jay 6-28 11:08 完整版(含分层选型 + 3 引擎版本更新 + ⚠️ pgvector CVE)
- 去重策略:立项
notes/database/vector-db-selection-2026.md,6-28 morning 加分层选型框架 + Qdrant v1.18 TurboQuant + Milvus 3.0 zero-copy + Pinecone Builder $20/月 + ⚠️ pgvector CVE-2026-3172:7 天内升级生产 PG
5.5 Substack 高质量信源多源汇聚(建议主题页立项)
- jay 6-26 (1) + 6-27 (6) + 6-28 (11) = 累计 18+ 条 Substack
- 去重策略:立项
notes/substack/high-quality-sources-2026.md,按 9 个主题群分类(AI 工程 / 安全 / RAG / 推理 / 评测 / 编码 Agent / Agent 记忆 / 经济 / 国际监管)
5.6 AI Agent 工程栈全景多源印证(建议主题页立项)
- jay 6-28 morning brief 7 高价值(The AI Engineer / Grab / OWASP / OpenCode / Cognee / Job Analysis / Jo Van Eyck)+ jay 6-27 0937 Neural Maze + jay 6-28 1050 #4 Anthropic + jay 6-28 0053 Cool Papers NOVA
- 去重策略:立项
notes/agent-stack/architecture-landscape-2026.md,按"6 层架构 + Grab + LangGraph + OpenCode + Cognee + NOVA + Anthropic Harness design"七维结构
5.7 生产 Agent 排障 SRE 多源印证(建议主题页立项)
- jay 6-28 1050 11 保留(Datadog + buildmvpfast + Anthropic + MLflow + Arize + RAGPerf + dataskew + Neural Maze + Simon Willison + Sean Goedecke + Addy Osmani)
- 去重策略:立项
notes/agent-engineering/production-sre-2026.md,按"生产遥测 + Trace 数据 + 官方实践 + 架构设计 + 调试工作流 + 多模态 RAG 基准 + 学习路线 + 真实经验 + RAG 工程反模式 + 工具实测 + AI 协作"11 维度结构
5.8 RM-Bench 增量分析(flyp 6-28 早读 B vs 6-27 简评)
- flyp 2026-06-27 1650 简评(8.0 / Accept Oral)+ flyp 2026-06-28 09:50 反方审稿(B)+ 与 RewardBench 2(ICLR 2026)对照
- 去重策略:6-28 反方审稿是 6-27 简评的增量分析(反方视角 + RewardBench 2 对照表),非重复;建议主题页
notes/post-training/rm-evaluation-2026.md与 RewardBench 2 共建
5.9 6-27 evening 棒缺失(Stephen 实例)
- 6-27 evening 棒(22:45)未产出:stephen 实例未写 6-27 evening 协调检查
- 影响:6-27 evening 至 6-28 morning 间的 14 小时无 Stephen 协调;本棒覆盖 6-27 12:45 → 6-28 12:45(24h),与历史 12h+12h 节奏不同
- 建议:6-28 evening 棒(22:45)恢复 12h 节奏后回正常
5.10 OpenClaw 审稿去偏(⚠️ Stephen 实例去偏)
- jay 6-28 morning brief #7 Jo Van Eyck YouTube 提到 OpenClaw
- 影响:与 6-27 1221 #7 OpenClaw vs Hermes 源码分析相同情境
- 建议:stephen 在主题页
notes/agent-architecture/整合时标注去偏 metadata("Stephen 实例运行环境");不主动推广或赞誉 OpenClaw;以反方视角对待 jay 引用条目
5.11 推理芯片信号(OpenAI Jalapeño 自研)
- Stephen 0157 OpenAI News 抓取 OpenAI + Broadcom Jalapeño inference chip(自研 AI 推理芯片)
- 首次出现的自研推理芯片信号:与 jay 6-28 11:08 vLLM/SGLang/TRT-LLM 第三方推理引擎形成对照
- 建议:立项
notes/industry/inference-chip-landscape-2026.md(OpenAI + Broadcom + Anthropic + Google 内部推理基础设施对比)
6. 缺口与待补查
6.1 6-28 morning 缺口
| 缺口 | 严重度 | 建议补查方向 |
|---|---|---|
| agent-to-agent 通信协议(A2A / ANP) | 🟡 中 | jay 6-28 evening 跟进(与 MCP 主题并列;6-28 morning 无相关条目) |
| 3D / NeRF / 世界模型深度跟进 | 🟡 中 | HF Daily 6-28 #4 In-Context World Modeling + #10 MVTrack4Gen + #15 Fast LeWorldModel + Sebastian Raschka KV Compressed Attention 已浮现;建议 flyp 6-28 evening 或 6-29 早读跟进 |
| 供应链 / 模型后门 / 数据投毒 | 🟠 中 | tom 6-28 evening 跟进(虽 6-27 MIRROR + Agents That Know Too Much 已部分覆盖) |
| flyp MIRROR 周日 deep read | 🟠 中 | 6-27 evening 棒建议 6-28 flyp MIRROR(arXiv 2606.26793)未兑现(flyp 6-28 早读选 Jets + RM-Bench);建议 flyp 6-29 周一跟进 |
| ⚠️ pgvector CVE-2026-3172 升级状态 | 🔴 高 | jay 6-26 evening + 6-28 afternoon 已立项,6-28 evening 棒前必须确认是否有 0.8.3 / 0.8.4 后续 patch 公告;7 天升级窗口已缩短 |
| ⚠️ Anthropic Fable 5 / Mythos 5 美政府暂停 | 🟠 中 | 监管风险信号,建议后续跟踪 Ben's Bites "Bye bye Fable" + "Record a skill" + "New Claude model - Fable" 主题;建议 jay 6-28 evening 跟进美政府 AI 监管动向 |
| TLDR AI 6-25 Anthropic accuses Alibaba | 🟡 低 | 知识产权 / 监管国际维度信号,建议后续核实 |
| Spark 实例 18 天空档 | ⚠️ 持续 | spark 草稿目录仍无新文件(比 6-27 morning 17 天 +1 天);cron review 11:25 已恢复;建议 Anan 决策是否介入(详见 §8) |
6.2 flyp 6-28 weekly notes 必查后续清单
- MIRROR(arXiv 2606.26793):6-29 周一早读跟进(flyp 6-27 weekly notes §0 留位置)
- Jets v2 / camera-ready:关注是否补充 SAE 对比实验(flyp 6-28 早读 (A) 必查后续)
- RM-Bench leaderboard 2026 更新:用 Qwen2.5-RM / Llama-3.1-RM 在 H100 上跑一遍验证 46.6% 结论是否在 2026 RM 上仍成立(flyp 6-28 早读 (B) 复现建议)
6.3 jay 6-28 morning 必查后续
- 0822 CSDN #4 LLMOps 7 阶段生命周期完整正文(本次未能成功抓取完整正文,核心工程细节待验证)
- 0822 CSDN #1 RAG 已死 5 下一代技术的 RAFT 部分(代码示例待精读)
- 1221 CSDN #1 vLLM vs Ollama SLO 排障 vLLM queue latency 监控接口版本兼容性(需核查 vLLM 0.6.x 版本)
- 1221 CSDN #4 A10 GPU vLLM 调参临界值表(
--enforce-eager+--max-num-seqs128 +host.docker.internalWSL2 陷阱)建议独立 FAQ
6.4 tom 6-28 morning 必查后续
- tom 6-28 radar Substack 0 条(与 6-27 1 条对比)—— Substack 信源不足,建议 6-28 evening 棒补充 Substack 信源
- MemStrata 5 天内第 3 次出现,是否有 v2 或作者 follow-up 工作?
7. 主题页候选更新(截至 6-28 12:45)
7.1 6-27 evening 棒 7 主题候选 + 6-28 morning 新增 6 主题候选 = 13 主题候选
| # | 主题页候选 | 6-28 morning 兑现 | 优先级 |
|---|---|---|---|
| 1 | Vector DB 2026 + CVE 跟踪(6-26 evening) | ✅ 加 jay 6-28 11:08 完整版 + ⚠️ pgvector CVE-2026-3172 紧急升级 | 🔥 紧急 + 立项 |
| 2 | RAG 范式迁移 2026(6-26 evening) | ✅ jay 6-28 0822 #1 + ByteByteGo EP220 + Cool Papers cs.IR 持续印证 | 🟠 立项条件具备 |
| 3 | vLLM/SGLang 推理引擎选型 2026(6-26 evening) | ✅ jay 6-28 11:08 三分天下 + SGLang NSA + TRT-LLM Blackwell 3-5x + GitHub Octoverse #1 | 🟠 立项条件具备 |
| 4 | 2026 H2 K8s AI 基础设施完整图谱(6-26 evening) | ✅ jay 6-28 11:08 K8s AI(66% GenAI 推理负载)+ 自主 AI Agent 威胁模型 | 🟡 立项条件具备 |
| 5 | KV cache 优化专题页 v2(6-26 evening) | ✅ 升级为 7 范式 + 6 arXiv + Sebastian Raschka 呼应 | 🔥 立项条件充分 |
| 6 | AI Agents Stack 2026 三视角汇总(6-26 evening) | ✅ jay 6-28 morning brief + 1050 + 0053 NOVA 完整印证 | 🟠 立项条件具备 |
| 7 | OWASP Top 10 Agents 2026 + MCP 安全三层防御(6-26 evening) | ✅ jay 6-28 morning brief #3 OWASP ASI 完整版 | 🟠 立项条件具备 |
| 8 | KV Cache 压缩范式 2026(6-28 morning 新增) | ✅ jay 11:08 + 11:09 双稿 + 7 范式 + 6 arXiv + Sebastian Raschka 同步 | 🔥 立项条件充分 |
| 9 | Substack 高质量研究信源全图谱 2026(6-28 morning 新增) | ✅ jay 6-28 单日净增 11 条 + 累计 18+ 条 | 🟠 立项条件具备 |
| 10 | 行业头部旗舰发布 2026 中期(6-28 morning 新增) | ✅ Stephen 7 信源 RSS 抓取首次覆盖 + OpenAI/Anthropic/DeepMind/Google/HF | 🟡 立项条件具备 |
| 11 | 生产 Agent 排障 SRE 实践 2026(6-28 morning 新增) | ✅ jay 6-28 1050 11 保留覆盖 4 维度 | 🟠 立项条件具备 |
| 12 | Reward Model 评测对照 2026(6-28 morning 新增) | ✅ flyp 6-28 早读 (B) RM-Bench + RewardBench 2 对照 | 🟠 立项条件具备 |
| 13 | AI 编码 Agent 横向评测 2026(6-28 morning 新增) | ✅ jay 6-28 morning brief #4 OpenCode + Stephen Ben's Bites + Simon Willison Fable 5 + Datasette Agent | 🟡 立项候选 |
7.2 主题页总数演进
- 6-25 evening:7 项候选
- 6-26 evening:7 项新增候选
- 6-27 morning:4 项新增候选
- 6-28 morning:6 项新增候选
- 累计:24 项候选
- 已立项:2 项(MCP 安全 + AI Agents Stack 2026)
- 立项条件具备:11 项(Vector DB / RAG 范式迁移 / 推理引擎选型 / K8s AI / KV Cache 压缩范式 / OWASP+三层防御 / Substack 信源 / 行业旗舰发布 / 生产 Agent 排障 / Reward Model 评测 / 多模态 agent 评测)
- 待立项:3 项(LangGraph / Agentic RAG 范式收敛 / AI 编码 Agent 横向)
- 弃选:8 项(OWASP / GitHub 可靠性 / MLSys 设计空间 / 移动端 AI / 企业 agentic RAG / Coding-Agent 周排行 / 3D/NeRF(待 flyp 跟进)/ Hermes(与 OpenClaw 合并))
7.3 6-28 evening 棒建议立项 2-3 项
- 🔥 立项建议 1:KV Cache 压缩范式 2026(立项条件最充分 + 7 范式 + 6 arXiv + Sebastian Raschka 同步 + jay 6-28 1050 RAGPerf benchmark 印证)
- 🔥 立项建议 2:生产 Agent 排障 SRE 实践 2026(jay 6-28 1050 11 保留覆盖 4 维度 + 跨 6 权威来源:Datadog / Anthropic / MLflow / Arize / buildmvpfast / Sean Goedecke + 1 Substack + 1 学术 RAG benchmark)
- 🔥 立项建议 3:Substack 高质量研究信源全图谱 2026(jay 单日净增 11 条 + 累计 18+ 条 + 9 条 🔴 高价值 + 9 主题群完整)
8. Spark 实例状态(持续关注)
8.1 现状
- 草稿目录
/shared/research-kb/inbox/spark/自 2026-06-10 后仅 2 份文件(1 份历史 agentic-rag-runtime-reliability.md + 1 份 6-27 1557-rss-gradient-flow.md RSS 抓取) - 截至 2026-06-28 持续 18 天空档(比 6-27 morning 17 天再 +1 天,比 6-27 evening 16 天再 +2 天)
- cron review 通道已恢复正常 ✅:最新 review 为 2026-06-28-1125(11:25,7.9KB,30 文件),最新 digest 为 2026-06-28-1125(11:25,2.5KB)
- 6-27 evening 棒 §8 提出的"6-27 cron review 仍未生成"问题已解决
8.2 Spark 替代方案(持续提议)
- 方案 A(现状):保留 cron review 通道(作为质量守门人),将 Spark 实例本身下线
- 方案 B:重启 Spark 实例任务调度(恢复 spark 草稿目录写入)
- 方案 C:将 cron review 文件名从
*-spark-24h-*改为*-auto-24h-*,明确 cron 独立于 Spark 实例 - 方案 D(新增):将 Spark cron review 归入 Stephen 实例归属,由 Stephen 负责协调处理(与 Stephen 当前承担的协调职责一致)
- Stephen 临时承接:6-28 weekly digest 启动棒(cron:034af2f3)尚未启动,本棒不主动补 weekly digest,由 flyp 周日反方审稿(已覆盖主题审稿)替代
8.3 cron 文件命名建议
- 当前文件命名:
*-spark-24h-review.md+*-spark-24h-digest.md - 建议改名:
*-auto-24h-review.md+*-auto-24h-digest.md,明确 cron 独立于 Spark 实例 - 理由:避免 Anan / 其他协调者误以为 cron 产出归属 spark 实例
9. 6-28 全日 P0/P1 兑现追踪
9.1 6-27 morning 棒 §9.2 主题页候选兑现情况
| # | 主题页候选 | 6-28 morning 兑现状态 |
|---|---|---|
| 1 | 多模态 agent 评测坐标系 2026 | ✅ 升级 + 加 jay 6-28 1050 RAGPerf + Anthropic Eval awareness |
| 2 | Agent 记忆工程 2026 | ✅ 升级 + 加 jay 6-28 11:08 KV cache 多层存储 + Sebastian Raschka |
| 3 | Agentic RAG 范式收敛 2026 | ✅ 升级 + 加 jay 6-28 0822 #1 GraphRAG/MM-RAG/Hierarchical/Adaptive/RAFT |
| 4 | LangGraph 状态机实战 2026 | ⚠️ 6-28 morning 无新条目(flyp 6-28 早读未涉及) |
9.2 6-28 morning 棒新增主题页候选
- KV Cache 压缩范式 2026(jay 11:08 + 11:09 + Sebastian Raschka)
- Substack 高质量研究信源全图谱 2026(jay 6-28 单日净增 11 条 + 累计 18+ 条)
- 行业头部旗舰发布 2026 中期(Stephen 7 信源 RSS 首次覆盖)
- 生产 Agent 排障 SRE 实践 2026(jay 6-28 1050 11 保留)
- Reward Model 评测对照 2026(flyp 6-28 早读 B)
- AI 编码 Agent 横向评测 2026(jay 6-28 morning brief #4 OpenCode + Stephen Ben's Bites)
9.3 6-28 evening 棒预期任务
- jay(继续主导,但建议补 spark / tom 接手 CSDN):
- 6-28 晚棒恢复日常节奏(晚间 1-2 份)
- 必做:pgvector CVE-2026-3172 后续修复追踪 + Anthropic Fable 5 / Mythos 5 监管风险信号跟踪 + TLDR AI 6-25 Anthropic accuses Alibaba 核实
- 建议立项:KV Cache 压缩范式 / 生产 Agent 排障 / Substack 信源 / 行业旗舰
- tom(保持 arXiv radar + HF Daily 节奏):
- 6-28 晚棒 1 份 radar
- 6-28 建议聚焦:Substack 信源补充(本次 0 条)+ 供应链 / 模型后门 / 数据投毒(与 6-27 MIRROR + Agents That Know Too Much 衔接)
- flyP(保持周日 deep read 节奏):
- 6-29 早棒做 MIRROR(arXiv 2606.26793)—— 6-27 evening 棒建议 + flyp 6-27 weekly notes §0 留位置
- 6-28 evening 棒可补 3D / NeRF / 世界模型 主题(HF Daily 6-28 #4 #10 #15 + Sebastian Raschka)
- 关注 Jets v2 / camera-ready 是否补充 SAE 对比
- Spark / cron review:
- 6-28 cron review 11:25 已恢复 ✅
- 6-28 cron digest 11:25 已恢复 ✅
- 建议 6-28 evening 棒前确认 cron 文件命名是否改为
*-auto-24h-* - Stephen(本实例):
- 6-28 evening 棒(22:45)做 6-28 全日协调收口(恢复 12h 节奏)
- 6-28 evening 棒建议立项主题:KV Cache 压缩范式 + 生产 Agent 排障 + Substack 信源全图谱
10. 发布前必须人工确认的事项
- 🔥 KV Cache 压缩范式 2026 立项优先级(§7.3 #1)—— jay 6-28 11:08 + 11:09 双稿 + 7 范式 + 6 arXiv + Sebastian Raschka 同步,立项条件最充分
- 🔥 pgvector CVE-2026-3172 升级状态(§5.4 + §6.1 + §9.3)—— 7 天升级窗口已缩短至 6-29;是否有 0.8.3 / 0.8.4 后续 patch 公告?
- 🔥 Spark 实例 18 天空档(§8)—— cron review 11:25 已恢复,但 spark 草稿目录仍空档;方案 A/C/D 哪个?
- ⚠️ Anthropic Fable 5 / Mythos 5 美政府暂停(§3.5 + §6.1)—— 监管风险信号,是否需要后续跟踪?
- 🔥 jay CSDN 单实例占比 100% 是否需要调整(§3.9)—— 累计 177 条 CSDN 草稿 100% 由 jay 产出,建议启动 spark / tom / flyp 的 CSDN 检索任务
- 🔥 Substack 主题页立项(§7.3 #3)—— jay 单日净增 11 条 + 累计 18+ 条,是否立项?
- flyp MIRROR 周日 deep read(§6.2 + §9.3)—— 6-27 evening 棒建议 6-28 早棒执行未兑现,6-29 周一执行?
- 6-27 evening 棒缺失(§5.9)—— stephen 实例未写 6-27 evening 协调检查,6-28 evening 棒是否恢复 12h 节奏?
- OpenAI + Broadcom Jalapeño inference chip(§3.5 + §5.11)—— 自研推理芯片信号,是否立项跟踪?
- OpenAI GPT-5.6 Sol 预览(§3.5)—— next-generation 模型预览,是否立项?
11. 元信息
- 本棒工具调用:8 次 exec + 3 次 read + 1 次 write(本文件)
- 本实例草稿目录:
/shared/research-kb/inbox/stephen/ - 已写入:
/shared/research-kb/inbox/stephen/2026-06-28-stephen-coordination-check.md - 未执行:git commit / git push / gh pr / 写入 review/ 或 published/
- 引用 Substack:The AI Engineer / Bhavishya Pandit / Alex Ewero × 2 / Cognee 官方博客 / Jo Van Eyck YouTube / Nathan Benaich State of AI / LLMs Research / AI Evaluation Digest / Simon Willison / The Neural Maze / Sean Goedecke / dataskew / Sebastian Raschka (Ahead of AI) / ByteByteGo / Cool Papers / Ben's Bites / TLDR AI / Addy Osmani
- 引用 arXiv:2606.26511 (MemStrata) / 2606.14397 (GauntletBench) / 2606.26080 (Progress Advantage) / 2606.16613 (CoffeeBench) / 2606.27288 (multi-model failure ceiling) / 2606.26916 (PhysRAG) / 2606.27192 (LISA) / 2606.23835 (ABACUS) / 2606.24775 (Agent-Native Memory) / 2606.27377 (DanceOPD) / 2606.26058 (DomainShuttle) / 2606.25763 (ShutterMuse) / 2606.26025 (In-Context World Modeling) / 2606.26790 (OPID) / 2606.26907 (Qwen-Image-Agent) / 2606.26300 (Verification Horizon) / 2606.27313 (ViQ) / 2606.26087 (MVTrack4Gen) / 2606.18394 (JetSpec) / 2606.24551 (GUI vs CLI) / 2606.25319 (V-Zero) / 2606.21661 (UnityShots) / 2606.26217 (Fast LeWorldModel) / 2601.11471 (LRKV) / 2604.26968 (Multi-Tier Memory) / 2603.02188 (MLRA) / 2605.15250 (GQLA) / 2601.11464 (MHA2MLA-VLM) / 2510.04476 (CCGQA) / 2603.10765 (RAGPerf) / 2606.27243 (NOVA) / 2410.16184 (RM-Bench) / 2606.26793 (MIRROR)
- 引用 OpenAI:GPT-5.6 Sol / Jalapeño inference chip / How agents are transforming work / Appia Foundation / Derya Unutmaz T cell 突破
- 引用 Anthropic:Economic Index Cadences / Claude Tag / LLM ATT&CK Navigator / Claude Code 实战 / ⚠️ Fable 5/Mythos 5 美政府暂停
- 引用 DeepMind:Gemini 3.5 Flash computer use / UK house-building / AI Control Roadmap / DiffusionGemma / $10M 多 Agent 安全资金
- 引用 Google AI:Google Finance / AMIE 疾病管理 Nature 论文 / Alabama $1.5B / Virginia / May 2026 AI updates
- 引用 HF Blog:vLLM Jobs / AllenAI hybrid / NVIDIA NeMo AutoModel / FFASR Leaderboard / IBM CUGA
- 引用 Substack 累计:jay 6-26 (1) + 6-27 (6) + 6-28 (11) = 18+ 条
Stephen 总协调检查 · 每日 2 次 · 2026-06-28 12:45 Asia/Shanghai