database · E1 预消化简报(2026-07-31)
Jay · cron_d71a4202 · 2026-07-31 20:20 CST 覆盖范围:Jul 29–31 inbox(jay/tom/flyp/spark/stephen)+ 近 3 日 paper_cards 数据截止:2026-07-31 20:00
执行摘要
状态:无显著新增量(无触发活文档 database.md 紧急更新的新条目)
本期(2026-07-31)database 主题 E1 预消化共深度检查了 35+ 份 inbox 文件(jay 今日 15 份 + 近两日 20 份 + tom/flyp/spark/stephen 各 2–3 份)、7 份 RSS、近 3 日 paper_cards 最新批次(Jul 31 ~80 张 + Jul 30 ~30 张 + Jul 29 ~50 张)。
无任何需要作为新条目写入 knowledge/database.md 的增量。Jul 29–31 窗口内 database 相关信号均为已知锚点的第三次+次独立来源复现,或属推理系统工程、Agent 基础设施、云原生运维范畴,不触发 database 主叙事新增。
活文档当前为 R-23(2026-07-31 00:40),全部 88+ arXiv ID + 3 CVE + 20 共识条目(C1-C20)+ 18 争议条目(D1-D18)+ 19 趋势 + 10 开放问题(O1-O10)硬资产完整保留。
检查过的来源清单
jay inbox(Jul 29–31,database 相关度排序)
| 文件 | 时间 | 关联度 | 摘要 |
|---|---|---|---|
2026-07-31T1735-jay-briefing-inference-stack-vecdb-substack.md |
7-31 17:35 | ★★★★☆ | TGI 维护模式 + Colibri C inference engine + vLLM/SGLang/TRT-LLM H100 benchmark + FP8 KV cache + Vector DB 2026 选型框架 + Substack 三篇精选;已在 engineering 主叙事覆盖 |
2026-07-31T1105-jay-five-category-briefing.md |
7-31 11:05 | ★★★★☆ | SIGMOD 2026 三篇 LLM serving 论文(CoDec/AlignedServe/HotPrefix)+ Memory-Centric KV Cache Server(HotInfra '26);见增量分析 §疑义条目 |
2026-07-31-engineering-database-backend-cloudnative.md |
7-31 全天 | ★★★★☆ | PG vs MySQL 2026 benchmark + PgBouncer/ProxySQL 生产配置 + CNCF K8s 排障 + eBPF 调优;非 database research,增量属工程实践类 |
2026-07-31-csdn-substack-ai-research.md |
7-31 | ★★★☆☆ | CSDN 工程实践;非 database research |
2026-07-31-ai-engineering-trending.md |
7-31 09:00 | ★★☆☆☆ | GitHub Trending;非 database 核心 |
2026-07-30-database-e1prep.md |
7-30 20:20 | ★★★★★ | 昨日 E1prep;"无显著新增量"结论;已在 R-22/R-23 覆盖 |
2026-07-30-database-backend-cloudnative.md |
7-30 | ★★★★☆ | PG vs MySQL benchmark;已在 R-23 §1 覆盖 |
2026-07-30-1508-jay-five-category-briefing.md |
7-30 15:08 | ★★★★☆ | D1 pgvector vs Qdrant vs Milvus p50/p99 数字表;D2 Qdrant v1.37 MCP;均在 R-22 覆盖 |
2026-07-30-1105-jay-five-category-briefing.md |
7-30 11:05 | ★★★★☆ | D1 Salt Technologies benchmark;D2 VectorDBBench 警示;均在 R-21/R-22 覆盖 |
2026-07-29-database-e1prep.md |
7-29 20:20 | ★★★★★ | 昨日 E1prep;"无显著新增量"结论;已在 R-21 覆盖 |
2026-07-29T1506-jay-five-category-briefing-p2.md |
7-29 15:06 | ★★★★☆ | D1 Salt Technologies Q1 benchmark + D2 VectorDBBench;已在 R-22 归档 |
2026-07-29-1105-jay-five-category-briefing.md |
7-29 11:05 | ★★★★☆ | D1 Milvus 3.0 lake-native / Oracle 向量搜索 / CockroachDB C-SPANN;已在 R-21 覆盖 |
tom inbox(Jul 29–31,database 相关)
| 文件 | 时间 | 关联度 | 摘要 |
|---|---|---|---|
2026-07-31T0840-agent-rag-longcontext-radar.md |
7-31 08:40 | ★★☆☆☆ | Agent/RAG/长上下文;非 database 核心 |
2026-07-30T0840-agent-rag-longcontext-radar.md |
7-30 08:40 | ★★☆☆☆ | Agent/RAG/长上下文;非 database 核心 |
2026-07-29T0840-agent-rag-longcontext-radar.md |
7-29 08:40 | ★★☆☆☆ | Agent/RAG/长上下文;非 database 核心 |
2026-07-29T2040-agent-rag-longcontext-radar.md |
7-29 20:40 | ★★☆☆☆ | Agent/RAG/长上下文;非 database 核心 |
2026-07-31-rag-e1prep.md |
7-31 | ★★☆☆☆ | RAG E1prep;非 database 核心 |
flyp / spark / stephen inbox(Jul 29–31,database 相关)
| 目录 | 文件 | 关联度 | 摘要 |
|---|---|---|---|
| flyp | 2026-07-30-multimodal-e1prep.md |
★☆☆☆☆ | 多模态;非 database 核心 |
| flyp | 2026-07-31-multimodal-e1prep.md |
★☆☆☆☆ | 多模态;非 database 核心 |
| spark | 2026-07-30-llm-infra-e1prep.md |
★★☆☆☆ | llm-infra E1prep;非 database 核心 |
| spark | 2026-07-31-llm-infra-e1prep.md |
★★☆☆☆ | llm-infra E1prep;非 database 核心 |
| stephen | 2026-07-31-ai-industry-e1prep.md |
★☆☆☆☆ | AI 行业 E1prep;非 database 核心 |
paper_cards(近 3 日新卡/更新卡)
| 批次 | 张数 | database 主分类数 | 摘要 |
|---|---|---|---|
| 7-31 20:00 批次 | ~80 张 | 0 | 旧 paper OpenAlex enrich(CNN/R-CNN/GAN/Code Llama/Toolformer 等);无新 database 相关 |
| 7-31 16:30 批次 | 10 张(arXiv 2607.26xxx 首批) | 0 | 主分类:agentic RL / speculative decoding / agentic reasoning;零 database |
| 7-30 20:00 批次 | ~30 张 | 0 | 均为旧 paper OpenAlex enrich(Toolformer 2302 / Code Llama 2308 等);无新 database 相关 |
| 7-29 20:00 批次 | ~50 张 | 0 | 主分类:multimodal/agent/evaluation/rag/llm-infra/coding;零 database 主分类 |
paper_cards 近 3 日 database 相关条目:无。最近入库 database 相关 paper_card 仍为 013-TrieHI (2606.16903,7-25) 和 054-VDB-HPC-Scaling-Paradox (2606.08950,7-25),均已在 R-23 覆盖。
RSS 来源(Jul 29–31)
| 来源 | 文件 | 关联度 | 摘要 |
|---|---|---|---|
| cool-papers | 2026-07-31-1001-rss-cool-papers.md |
★☆☆☆☆ | cs.IR 论文;非 database 核心 |
| cool-papers-ir | 2026-07-31-1001-rss-cool-papers-ir.md |
★★☆☆☆ | cs.IR;非 database 核心 |
| raschka | 2026-07-31-1000-rss-raschka.md |
★☆☆☆☆ | AI 前沿;非 database 核心 |
| lilian-weng | 2026-07-31-1002-rss-lilian-weng.md |
★★☆☆☆ | Agent 安全;非 database 核心 |
| import-ai | 2026-07-31-1003-rss-import-ai.md |
★☆☆☆☆ | AI 新闻;非 database 核心 |
| msr-blog | 2026-07-31-1002-rss-msr-blog.md |
★★☆☆☆ | MSR Blog;非 database 核心 |
| simon-willison | 2026-07-31-1000-rss-simon-willison.md |
★★☆☆☆ | AI 工程;非 database 核心 |
增量分析
今日 database 信号定性
Jul 29–31 全部为已知锚点的第三次+次独立来源确认,无新 arXiv ID(database research):
| 信号 | 来源 | R-23 覆盖情况 |
|---|---|---|
| TGI 正式进入维护模式(2026-03-21) | five-category-briefing 17:35 §1 | 属 inference engine 迁移,不触发 database 主分类 |
| Colibri C inference engine(GLM-5.2 744B MoE @ 25GB RAM) | five-category-briefing 17:35 §2 | 推理系统工程;已在 llm-infra 覆盖 |
| vLLM vs SGLang vs TRT-LLM H100 benchmark(Spheron 2026) | five-category-briefing 17:35 §3 | 推理引擎选型;非 database research |
| FP8 KV-Cache 50% 显存节省(Jarvis Labs) | five-category-briefing 17:35 §4 | KV cache 优化;与 §2.4 交叉但非 database research |
| LMCache 2026 Q2 Roadmap(vLLM/SGLang/TRT-LLM 统一 KV 中间件) | five-category-briefing 17:35 §5 | KV cache 基础设施;已在 llm-infra 覆盖 |
| Vector DB 2026 选型框架(Pratik Rupareliya Analytics Vidhya) | five-category-briefing 17:35 §6 | 选型决策表;已在 R-21 §2.1 锚点覆盖 |
| SIGMOD 2026 CoDec / AlignedServe / HotPrefix | five-category-briefing 11:05 §Database | 见§疑义条目 |
| Memory-Centric KV Cache Server(CXL-PIM,HotInfra '26) | five-category-briefing 11:05 §Database | 见§疑义条目 |
| PG vs MySQL 2026 benchmark(BinaryIgor 2026-01) | engineering-database 7-31 | 工程实践;非 database research |
| PgBouncer / ProxySQL 生产配置(HostMyCode 2026-05-22) | engineering-database 7-31 | 工程实践;非 database research |
| CNCF K8s 排障实战(CrashLoopBackOff / OOMKilled) | engineering-database 7-31 | 云原生运维;非 database research |
| eBPF 内核调优(OneUptime 2026-06-23) | engineering-database 7-31 | Linux 性能;非 database research |
疑义条目(不触发主叙事更新,建议归档至 llm-infra 主题)
以下条目来自 Jul 31 上午简报,不触发 database 主分类新增,但与现有 §2.4 有交叉,建议在 llm-infra 主题页归档:
1. SIGMOD 2026 三篇 LLM Serving 论文(Database 会议新方向)
| 论文 | 出处 | 核心贡献 | 建议归口 |
|---|---|---|---|
| CoDec: Prefix-Shared Decoding Kernel for LLMs | ACM SIGMOD 2026(2026-05-18 published) | 前缀共享解码内核,多请求间共享前缀时减少冗余计算;与 SGLang RadixAttention 技术路线正交但目标一致 | → llm-infra §disaggregated-inference |
| AlignedServe: Prefix-aware Batching | ACM SIGMOD 2026 | 前缀感知的 batching 调度,高吞吐低计算浪费的 LLM serving 系统 | → llm-infra §batching-scheduling |
| HotPrefix: Hotness-Aware KV Cache Scheduling | ACM SIGMOD 2026 | 热aware KV cache 调度,实现高效前缀共享 | → llm-infra §kv-cache-scheduling |
分析:三篇论文以"数据库系统视角"处理 LLM inference 调度问题,是 2026 年 SIGMOD 明显增加 LLM serving 论文 track 的证据。但其核心贡献(prefix sharing / batching / KV cache scheduling)属于 inference systems 而非 database research 本身。与 R-23 §2.4 中 KVServe / SpectrumKV / Mooncake 同属 KV cache 分离式架构大类,但 SIGMOD 这三篇尚无 arXiv ID(ACM 官方出版),建议在 llm-infra 主题归档。
2. Memory-Centric KV Cache Server(HotInfra '26,ISCA '26 联合工作坊)
- 来源:
hotinfra.org/2026/papers/hotinfra26-final59.pdf - 核心数据:DeepSeek-R1-671B,32K tokens 生成;PIM 方案比 H100 集群吞吐高 2.4×,CapEx 降低 20.6×,OpEx 降低 16.8×,Cost/Mtokens 降低 39.7×,Tokens/Watt 提升 29.5×
- 定性:CXL-PIM 架构工程可行性重要证据;但属于 inference systems storage 方向,建议 → llm-infra §disaggregated-inference(与 Mooncake/KVServe/SpectrumKV 并列)
可引用 arXiv 号列表(本期无新增,沿用 R-23)
| arXiv 号 | 标题 | 与 database 主题关系 | 收录轮次 |
|---|---|---|---|
| 2607.15576 | Yi: Efficient and Effective In-place Graph-based Vector Index Updates | 直接:向量 DB 原地更新 | R-20 |
| 2606.16903 | TrieHI: Directory-Aware Query in Vector DBs | 直接:向量 DB 索引结构 | R-20 |
| 2606.08950 | When More Cores Hurts: VDB HPC Scaling Paradox | 直接:向量 DB 超大规模扩展悖论 | R-20 |
| 2605.17613 | VeriCache: KV Cache Compression | 直接:KV Cache 压缩,DB×AI 推理交叉 | R-20 |
| 2509.12384 | Qdrant on HPC Supercomputer | 直接:Qdrant 分布式实测 | R-20 |
| 2605.17152 | LSM-VEC: LSM-tree + Vector Search | 直接:LSM-tree + 动态向量搜索 | R-20 |
| 2607.07696 | Jailbreak: Breaking Database Lock-in | 直接:LLM×DB 字节层安全 | R-18 |
| 2607.14811 | PA-HDP: Prompt-Aware Dynamic Hierarchical DP | 直接:RAG 数据敏感差分隐私 | R-18 |
| 2605.15957 | GPU Vector Search in Relational Engines | 直接:GPU × 关系引擎向量搜索,NVLink 决定性 | R-18 |
| 2602.02057 | QVCache: Query-level Vector Cache | 直接:查询级向量缓存 | R-18 |
| 2602.11443 | Filtered ANN Benchmark | 直接:ANN benchmark 方法论 | R-18 |
| 2602.22805 | VeloANN | 直接:内存受限向量搜索 | R-18 |
| 2606.29708 | KVServe (SIGCOMM 2026) | 交叉:KV cache 通信压缩,disaggregated inference | R-22 交叉 |
| 2606.08635 | SpectrumKV (SIGCOMM 2026) | 交叉:per-token 混合精度 KV cache 传输 | R-22 交叉 |
值得警惕的矛盾或待核实说法(维持 R-23 既有警示,无新增)
| # | 说法 | 警示类型 | 状态 |
|---|---|---|---|
| D6 | GPU Vector Search in Relational Engines "关系组件从 GPU 受益 > 向量搜索组件"(arXiv 2605.15957) | ⚠️ 待独立复现 | R-20 维持 |
| D7 | pgvector 优化器 ef_search > 200 绕道 Seq Scan + Sort(365ms vs 2.5ms,DBI-Services 2026-03) | ⚠️ 未说明 PG 版本/硬件/向量维度配置 | R-20 维持 |
| D8 | Jailbreak 字节层 27× 吞吐提升(arXiv 2607.07696,AIDB 2026) | ⚠️ 等同行评审确认 | R-21 维持 |
| D14 | HPC Scaling Paradox 256 workers 仅 5.46× 提速(arXiv 2606.08950) | ⚠️ 单一实验环境,待第三方复现 | R-20 维持 |
| D15 | PostgreSQL-V 8.9× vs pgvector(CIDR 2026,Purdue Jianguo Wang) | ⚠️ benchmark 环境未公开,pgvector 版本相关 | R-20 维持 |
| D16 | pgvector HNSW ef_search ≤ 200 是工程经验阈值还是 PostgreSQL 优化器的固有缺陷? | ⚠️ 是否在 PG 19 + pgvector 0.9 修复待确认 | R-20 维持 |
| D17 | llm-d K8s AI 编排层 vs 数据库 Operator 边界 | ⚠️ 生产最佳实践尚未固化 | R-20 维持 |
| D18 | pgmnemo 四路融合在 PG 优化器下是否成为新的优化器决策压力 | ⚠️ benchmark 协议 "272-session vs paper's 5882-turn (22× smaller)" 口径待统一 | R-22 维持 |
下一步建议
-
活文档当前 R-23 无需紧急更新:Jul 29–31 全部信号均已入库或属相邻主题。下一轮增量待: - VecDB@VLDB2026(2026-09-04 Boston)会后论文公布 - SIGMOD 2026 正式版论文集出版(当前仅 warm-up papers 可见) - pgvector 0.9 是否随 PG 19 GA(2026-09)发布 - EMNLP / CIKM 2026 截稿(系统方向),可能有 database × LLM 新投稿 - Milvus 3.0 正式版发布(当前为 3.0.0-beta) - SIGMOD 2026 CoDec / AlignedServe / HotPrefix 三篇是否有 arXiv 编号(ACM 官方出版后通常会有)
-
Jul 29–31 database-adjacent 主题归口建议(供其他主题 E1prep 参考): - SIGMOD 2026 CoDec / AlignedServe / HotPrefix + Memory-Centric KV Cache(HotInfra '26) → llm-infra 主题页 §disaggregated-inference(KV cache 通信压缩/调度) - Colibri C inference engine(744B MoE @ 25GB RAM) → llm-infra 主题页 §local-inference - TGI 进入维护模式 → engineering 主题页 §inference-engineering - FP8 KV-Cache 50% 显存节省(vLLM Jarvis Labs) → llm-infra 主题页 §kv-cache-optimization - LMCache 2026 Q2 Roadmap → llm-infra 主题页 §kv-cache-infrastructure
检查过的来源完整清单
jay inbox(Jul 29–31):2026-07-31 全量(15份)+ 2026-07-30 database-e1prep + five-category-briefing×2 + engineering-database-backend-cloudnative + 2026-07-29 database-e1prep + five-category-briefing×2 + evening-hn-trending + engineering-filter 等
tom inbox(Jul 29–31):agent-rag-longcontext-radar×4 + rag-e1prep×2 + hf-daily×1
flyp inbox(Jul 29–31):multimodal-e1prep×2
spark inbox(Jul 29–31):llm-infra-e1prep×2 + agent-e1prep×2
stephen inbox(Jul 29–31):ai-industry-e1prep×1 + news-x-vip-radar×1
paper_cards(Jul 29–31):~160 张新卡/更新卡,零 database 主分类
RSS 来源:cool-papers + cool-papers-ir + raschka + lilian-weng + import-ai + msr-blog + simon-willison + bytebytego + nathan-benaich + karpathy + fireship(各 Jul 29/30/31 共 3 批次)
Jay · 2026-07-31 20:20 (CST) · database E1 预消化 · cron_d71a4202