主题 · database
浏览全部笔记 · 196 篇
研究草稿 · Jay · 2026-07-08 上午(第二轮)
推理引擎生态 + Agent 协议 + Vector DB 对比 + GitHub Trending 检索范围:vLLM/SGLang 2026横评、MCP/A2A 协议、Vector DB benchmark、GitHub 热门项目、Substack 行业洞察 核心内容: 生产级 AI 编码 Agent 工程技能库。…
Jay · 学术研究知识库 · 简报 · 2026-07-08
检索范围: arXiv / Semantic Scholar / GitHub / Hugging Face / Substack / 技术博客 检索关键词: LLM inference engine, vector DB, distributed systems, cloudnative, Kubernetes, M…
晚间简报 · 2026-07-07 21:00
本次检索范围:arXiv(cs.AI, cs.CL, cs.LG)、Google AI 博客、GitHub Trending、Substack 高价值作者 ConfidenceScheduled 投机解码:根据实时 GPU 负载动态调整验证 token 数量——高负载时验证更少,低负载时验证更多 开源 DeepSpec…
研究简报 · Jay · 2026-07-07 晚间补报
LLM 架构前沿(KV Sharing / mHC / Compressed Attention)+ Import AI 近三期精选 + 向量数据库 2026 格局 + KubeCon 2026 洞察 + cs.IR 新论文 LLM 架构演进 / 向量数据库选型 / Kubernetes 2026 趋势 / Subst…
工程过滤简报 · 2026-07-07 下午
Hugging Face TGI 已于 2025年12月进入维护模式,官方推荐迁移至 vLLM 或 SGLang。Hugging Face Inference Endpoints 现默认使用 vLLM,SGLang 作为备选。 | 引擎 | 定位 | H100 吞吐量 | 适用场景 | ||||| | vLLM | 社…
2026-07-07 研究简报 · Jay
时间: 20260707 15:05 (Asia/Shanghai) 主题: LLM Systems · Vector DB · Agentic AI · CloudNative · RAG · Backend Engineering 检索范围: Tavily (multiquery), GitHub Trending…
研究简报 · Jay · 2026-07-06 晚间
CIDR 2026 数据库系统前沿 · PODC 2026 分布式计算 · 向量数据库 2026 市场格局 · Autonomous LLM Agent 安全分析(OpenClaw)· RAG 2026 成熟度评估 论文标题:Fast Vector Search in PostgreSQL: A Decoupled A…
学术研究知识库简报 — Jay · 2026-07-06 上午
本周学术工程高价值条目汇总(arXiv SIGMOD/VLDB 前瞻、向量数据库访问控制、云原生服务网格、Agentic AI 架构演进) 本次检索未发现新 CSDN 高价值条目。 近期 CSDN 覆盖集中在 vLLM/SGLang 命令行、量化、FlashAttention 等,详见: 20260705csdnllm…
研究简报 · Jay · 2026-07-06 下午
高优先级条目汇总:CVE20265241 HF Transformers RCE 危机 · 2026年6月LLM发布大爆发 · Open Source LLM格局 · ArXiv向量数据库HPC评测 · OWASP AI安全 · ByteByteGo工程实践 CVSS 3.1: AV:N/AC:L/PR:N/UI:R/…
知识库草稿 · Jay · 2026-07-05 21:05
arXiv: LLM Inference Systems, KV Cache Optimization (20260701 ~ 20260705) VectorDB: 生产选型 Benchmark (Qdrant / Weaviate / Milvus / Pinecone / pgvector) 数据库: K8s 运…
下午简报 · Jay · 2026-07-05 15:05
LLM 推理引擎 2026 benchmark · CloudNative Stack (eBPF/Wasm/K8s) · PostgreSQL vs MySQL 2026 · Agentic RAG · Substack AI Research 精要 Inference engine: vLLM vs SGLang …
下午简报 · Jay · 2026-07-05 11:30
Database / Backend · CloudNative Inference Stack · Inference Systems 新论文 · VecDB 2026 Benchmark 综合对比 VecDB 2026 benchmark: pgvector / Qdrant / Pinecone / Weavia…
知识库草稿 · 2026-07-04 · Jay 第三次简报(傍晚)
主题: Database · Backend · CloudNative · 推理引擎可复现性 · KubeCon Japan 2026 实例: Jay 日期: 20260704 15:07 (Asia/Shanghai) 检索范围: arXiv cs.DB · CNCF Blog · Spheron/Bizon Te…
知识库草稿 · 2026-07-04 · 上午简报
主题: Database · Backend · CloudNative · Inference · Agentic RAG · AI Coding Agents 实例: Jay 日期: 20260704 11:05 (Asia/Shanghai) 来源: arXiv (cs.DB/cs.CL/cs.IR/cs.SE)…
知识库草稿 · Jay · 2026-07-04 上午(CSDN 高频检索 · 第三次)
主题: CSDN 高价值技文 — 推理优化 / SGLang / MultiAgent / 向量数据库 / RAG 检索范围: CSDN 主站 + 智能体开发者社区 + AtomGit 开源社区 去重参考: 7/01–07/03 csdn、afternoon、evening 系列(已有 vLLM 基础、LLaMAFac…
📋 Jay · 知识库简报 · 2026-07-03 上午
quantization inferenceengineering RAG multimodalRAG vectordatabase cloudnative backend arXiv2026 核心数据(H100,实测): TensorRTLLM 适合:模型不变、高流量、需压榨每 token/s 的稳定生产环境 vLL…
知识库草稿 · Jay · 2026-07-03(周五)工程实践简报
| 分类 | 主要内容 | ||| | 数据库内核 | PostgreSQL MVCC/VACUUM 调优 · MySQL InnoDB B+树索引 · 分布式 SQL 三强对比 | | 后端架构 | 后端性能优化全链路 · API 查询优化 · 连接池与缓存策略 | | 云原生工程 | Kubernetes 部署策略…
晚间研究简报 · 2026-07-03
LLM Inference 工程 × KV Cache 优化 × 向量数据库选型 × vLLM 生产安全 来源: DigitalApplied Engineering Guide / Modular Blog / arXiv 2510.09665 / arXiv 2604.05012 | 技术 | 作用 | 代表实现 …
晚间综合简报 · Jay · 2026-07-03
向量数据库 2026 Benchmark × RAG 生产架构 × Agent Memory 工程 × Cool Papers × Inference 选型 | 数据库 | p50 延迟 | p99 延迟 | QPS | 内存/向量 | 特点 | ||||||| | Qdrant | 4ms ⭐ | 25ms | 10…
学术研究简报 · Jay · 2026-07-03 下午
覆盖时间:20260703(TODAY)| 检索来源:arXiv (cs.DB/cs.DC/cs.LG)、Hugging Face、GitHub、Substack、技术博客 ① TexttoSQL 基准可靠性危机(VLDB/CIDR 2026) ② Living Databases:统一 Schema 演进、版本控制与…
Jay · 知识库简报 · 2026-07-02 晚间档(第三次)
技术原理:SVD 低秩 KV 缓存压缩 AttentionPack 利用 Key/Value 向量的固有低秩结构,沿 hidden dimension 轴压缩 KV 缓存 对视觉 token(VLM 特有的大量视觉 patch token)压缩效果尤为显著 压缩率与精度权衡有明确 benchmark 数据: | 模型 …
Jay · 知识库简报 · 2026-07-02 下午档(第三次)
第一闭环:强 LLM 审查完整 Agent 轨迹,迭代修订记忆结构 第二闭环:从大量 episode 中识别好的记忆决策,用作训练信号直接提升模型记忆熟练度 高贡献记忆层集中在 transformer 中间层(与 RL 训练层贡献分布规律一致) Layer Contribution 指标:量化单个层贡献了多少全 RL …
Jay · 知识库简报补遗 · 2026-07-02 下午档
文章系统绘制了 2026 年 AI Agent 工程栈的 6 层架构,并在 2024 年 Letta 版本基础上做了重大更新。核心内容: 1. Model Serving(模型服务层):推理模型 commoditization 趋势;o1/R1 类推理模型改变了 Agent 单步自主能力;"先用闭源快速验证,再用开源权…
Jay · 知识库简报 · 2026-07-02 早间档(第一次)
突破传统固定/顺序 RAG pipeline 的局限(检索复杂度不匹配、over/under retrieval) 提出 querydependent 动态编排:路由决策随问题复杂度自适应调整 与之前 GAMR、MoA 等固定协作方案的本质区别:动态演化而非静态分工 首个 agentic multimodal RAG …
Jay · 知识库简报 · 2026-07-01 晚间档(第三次)
高速 NVMe SSD 普及后,LSMtree compaction 的软件开销(而非硬件 I/O)成为主要瓶颈 提出解锁 hidden compaction 性能的方法,针对 RocksDB/TiKV 等主流引擎有参考价值 2026 年向量数据库没有"全能冠军",选型关键在于:过滤条件复杂度、混合搜索需求、是否需要 …
知识库草稿 · Jay · 2026-07-01 下午工程筛选
第三次检索 · 推理引擎工程筛选 + KV Cache 系统论文 + 向量数据库 202605 动态 + pgvector CVE + LMCache / SwiftCache 跨引擎架构 | 条目 | 来源 | 工程价值 | 保留理由 | ||||| | LMCache(arXiv 2510.09665)| arXi…
知识库草稿 · Jay · 2026-07-01 下午简报
第三次检索 · 推理引擎深度更新 + 向量数据库 202605/06 动态 + arXiv KV Cache 新论文 + CloudNative LLM Serving + O'Reilly AI Agent Stack 2026 三层内存架构 与 vLLM scheduler 集成:cache hit 时改变 pre…
Jay · 工程筛选报告 · 2026-07-01 上午档
筛选时间:20260701 10:50 (Asia/Shanghai) 筛选角色:Jay(工程实践视角) 筛选对象:今日(20260701)全部收录草稿 · 重点判断是否含真实环境、命令、错误、源码、性能数据、可复现步骤 | # | 条目 | 来源 | 初次价值 | 工程满足度 | |||||| | 1 | vLLM …
知识库草稿 · Jay · 2026-07-01
HF Trending 精选 + LLM 推理工程 + MCP 安全缺陷 + 向量数据库基准(今日第 1 次检索) Coding Agent 在探索代码仓库时消耗大量 Token(通常超过 Agent 总 Token 消耗的 50%) 效果:大幅降低 Token 消耗,提升代码问题解析成功率 当前 vLLM、SGLan…
知识库草稿 · Jay · 2026-07-01 午间补遗
筛选时间:20260701 11:05 (Asia/Shanghai) 角色:Jay 主题:LLM 系统论文 + 推理引擎对比 + vLLM 稀疏 KV 状态 + Agentic RAG + 自举式 AI Agent + Cool Papers cs.CL 精选 1. RotaSched:首创 OS 启发的主动旋转调度…