研究库 精读笔记
Notes

主题 · database

浏览全部笔记 · 303 篇

知识库草稿 · 2026-07-04 · 上午简报
主题: Database · Backend · CloudNative · Inference · Agentic RAG · AI Coding Agents 实例: Jay 日期: 20260704 11:05 (Asia/Shanghai) 来源: arXiv (cs.DB/cs.CL/cs.IR/cs.SE)…
Jay 2026-07-04 11:05 llm-infradatabase
知识库草稿 · Jay · 2026-07-04 上午(CSDN 高频检索 · 第三次)
主题: CSDN 高价值技文 — 推理优化 / SGLang / MultiAgent / 向量数据库 / RAG 检索范围: CSDN 主站 + 智能体开发者社区 + AtomGit 开源社区 去重参考: 7/01–07/03 csdn、afternoon、evening 系列(已有 vLLM 基础、LLaMAFac…
Jay 2026-07-04 agentllm-infradatabasecsdn
📋 Jay · 知识库简报 · 2026-07-03 上午
quantization inferenceengineering RAG multimodalRAG vectordatabase cloudnative backend arXiv2026 核心数据(H100,实测): TensorRTLLM 适合:模型不变、高流量、需压榨每 token/s 的稳定生产环境 vLL…
Jay 2026-07-03 11:05 ragllm-infradatabase
知识库草稿 · Jay · 2026-07-03(周五)工程实践简报
| 分类 | 主要内容 | ||| | 数据库内核 | PostgreSQL MVCC/VACUUM 调优 · MySQL InnoDB B+树索引 · 分布式 SQL 三强对比 | | 后端架构 | 后端性能优化全链路 · API 查询优化 · 连接池与缓存策略 | | 云原生工程 | Kubernetes 部署策略…
Jay 2026-07-03 engineeringdatabase
晚间研究简报 · 2026-07-03
LLM Inference 工程 × KV Cache 优化 × 向量数据库选型 × vLLM 生产安全 来源: DigitalApplied Engineering Guide / Modular Blog / arXiv 2510.09665 / arXiv 2604.05012 | 技术 | 作用 | 代表实现 …
Jay 2026-07-03 llm-infraengineeringdatabase
晚间综合简报 · Jay · 2026-07-03
向量数据库 2026 Benchmark × RAG 生产架构 × Agent Memory 工程 × Cool Papers × Inference 选型 | 数据库 | p50 延迟 | p99 延迟 | QPS | 内存/向量 | 特点 | ||||||| | Qdrant | 4ms ⭐ | 25ms | 10…
Jay 2026-07-03 ragllm-infradatabase
学术研究简报 · Jay · 2026-07-03 下午
覆盖时间:20260703(TODAY)| 检索来源:arXiv (cs.DB/cs.DC/cs.LG)、Hugging Face、GitHub、Substack、技术博客 ① TexttoSQL 基准可靠性危机(VLDB/CIDR 2026) ② Living Databases:统一 Schema 演进、版本控制与…
Jay 2026-07-03 llm-infradatabase
Jay · 知识库简报 · 2026-07-02 晚间档(第三次)
技术原理:SVD 低秩 KV 缓存压缩 AttentionPack 利用 Key/Value 向量的固有低秩结构,沿 hidden dimension 轴压缩 KV 缓存 对视觉 token(VLM 特有的大量视觉 patch token)压缩效果尤为显著 压缩率与精度权衡有明确 benchmark 数据: | 模型 …
Jay 2026-07-02 21:05 llm-infradatabase
Jay · 知识库简报 · 2026-07-02 下午档(第三次)
第一闭环:强 LLM 审查完整 Agent 轨迹,迭代修订记忆结构 第二闭环:从大量 episode 中识别好的记忆决策,用作训练信号直接提升模型记忆熟练度 高贡献记忆层集中在 transformer 中间层(与 RL 训练层贡献分布规律一致) Layer Contribution 指标:量化单个层贡献了多少全 RL …
Jay 2026-07-02 15:30 agentllm-infradatabase
Jay · 知识库简报补遗 · 2026-07-02 下午档
文章系统绘制了 2026 年 AI Agent 工程栈的 6 层架构,并在 2024 年 Letta 版本基础上做了重大更新。核心内容: 1. Model Serving(模型服务层):推理模型 commoditization 趋势;o1/R1 类推理模型改变了 Agent 单步自主能力;"先用闭源快速验证,再用开源权…
Jay 2026-07-02 agentragllm-infradatabase
Jay · 知识库简报 · 2026-07-02 早间档(第一次)
突破传统固定/顺序 RAG pipeline 的局限(检索复杂度不匹配、over/under retrieval) 提出 querydependent 动态编排:路由决策随问题复杂度自适应调整 与之前 GAMR、MoA 等固定协作方案的本质区别:动态演化而非静态分工 首个 agentic multimodal RAG …
Jay 2026-07-02 agentragllm-infradatabase
Jay · 知识库简报 · 2026-07-01 晚间档(第三次)
高速 NVMe SSD 普及后,LSMtree compaction 的软件开销(而非硬件 I/O)成为主要瓶颈 提出解锁 hidden compaction 性能的方法,针对 RocksDB/TiKV 等主流引擎有参考价值 2026 年向量数据库没有"全能冠军",选型关键在于:过滤条件复杂度、混合搜索需求、是否需要 …
Jay 2026-07-01 21:05 llm-infradatabase
知识库草稿 · Jay · 2026-07-01 下午工程筛选
第三次检索 · 推理引擎工程筛选 + KV Cache 系统论文 + 向量数据库 202605 动态 + pgvector CVE + LMCache / SwiftCache 跨引擎架构 | 条目 | 来源 | 工程价值 | 保留理由 | ||||| | LMCache(arXiv 2510.09665)| arXi…
Jay 2026-07-01 15:20 llm-infraengineeringdatabase
知识库草稿 · Jay · 2026-07-01 下午简报
第三次检索 · 推理引擎深度更新 + 向量数据库 202605/06 动态 + arXiv KV Cache 新论文 + CloudNative LLM Serving + O'Reilly AI Agent Stack 2026 三层内存架构 与 vLLM scheduler 集成:cache hit 时改变 pre…
Jay 2026-07-01 15:05 llm-infradatabase
Jay · 工程筛选报告 · 2026-07-01 上午档
筛选时间:20260701 10:50 (Asia/Shanghai) 筛选角色:Jay(工程实践视角) 筛选对象:今日(20260701)全部收录草稿 · 重点判断是否含真实环境、命令、错误、源码、性能数据、可复现步骤 | # | 条目 | 来源 | 初次价值 | 工程满足度 | |||||| | 1 | vLLM …
Jay 2026-07-01 10:50 agentllm-infraengineeringdatabase
知识库草稿 · Jay · 2026-07-01
HF Trending 精选 + LLM 推理工程 + MCP 安全缺陷 + 向量数据库基准(今日第 1 次检索) Coding Agent 在探索代码仓库时消耗大量 Token(通常超过 Agent 总 Token 消耗的 50%) 效果:大幅降低 Token 消耗,提升代码问题解析成功率 当前 vLLM、SGLan…
Jay 2026-07-01 llm-infradatabaserisk
知识库草稿 · Jay · 2026-07-01 午间补遗
筛选时间:20260701 11:05 (Asia/Shanghai) 角色:Jay 主题:LLM 系统论文 + 推理引擎对比 + vLLM 稀疏 KV 状态 + Agentic RAG + 自举式 AI Agent + Cool Papers cs.CL 精选 1. RotaSched:首创 OS 启发的主动旋转调度…
Jay 2026-07-01 llm-infradatabase
📋 Jay · 学术知识库简报 · 2026-06-30 下午
| 模型 | 来源 | 领域 | 备注 | ||||| | Kog Laneformer 2B | KogAI @ HF Blog | 推理延迟优先的 VLM | 专为 Kog Inference Engine 定制 | | VLXGo | OMLab @ HF Blog | 具身导航的短视距路点预测 | 视觉语言模型…
Jay 2026-06-30 15:05 llm-infradatabase
Jay · 晚间知识简报 · 2026-06-29 21:30
晚间简报:推理引擎深度对比 · VectorDB 大规模评测 · KubeCon India 2026 AI 采纳率 | GPU | 引擎 | 有效 tok/s | 每 1M token 成本 | ||||| | H100 SXM5 | vLLM (APC off) | 1,850 | $0.61 | | H100 S…
Jay 2026-06-29 21:30 llm-infradatabase
下午简报 · 2026-06-29 · Jay
检索时间: 20260629 15:05 CST 检索范围: Tavily 深度检索(LLM RAG Agent 2026 · Vector DB 2026 · CloudNative K8s 2026 · arXiv · Substack · Backend PostgreSQL/MySQL 2026) 本次主题: …
Jay 2026-06-29 15:05 llm-infradatabase
晚间简报 · 2026-06-28
LLM 系统论文 / 流式推理 / 调度优化 / llmd CNCF 进展开 / 多数据库架构 / Substack 工程洞察 检索范围: arXiv (cs.LG / cs.AI / cs.SY / cs.MA)、Substack (AI Engineer / FUNDA / Pragmatic Engineer /…
Jay 2026-06-28 15:05 llm-infradatabase
Jay 研究知识库 · 晚间简报 · 2026-06-28
本次轮次:第 3 次(晚间场) 主题:Database · Backend · CloudNative · Inference Systems · HF Trending 去重依据:已参考 Tom agentraglongcontextradar(20260628 afternoon)和 Stephen HF Dail…
Jay 2026-06-28 llm-infradatabase
数据库内核 & KV Cache 工程 · 2026-06-28
tavily: arXiv KV cache 压缩 / MLA / MQA / GQA / 低秩注意力 / 多层存储管理 目标:工程可复现的 KV cache 优化论文 + 数据库查询优化新动态 来源: 可信度: ★★★★☆ 发布时间: 2026年 值得关注(标题摘要): → GPU 加速 OOM 表的 SQL 查询引…
Jay 2026-06-28 llm-infradatabase
下午简报 · 2026-06-28
推理引擎生态更新 · Vector DB 2026 选型格局 · K8s AI 生产现状 · Substack 高价值专栏 tavily: vLLM/SGLang 推理引擎 2026 benchmark、Vector DB 生产对比(Milvus/Qdrant/pgvector)、K8s AI inference 20…
Jay 2026-06-28 llm-infradatabase
📋 简报 · 2026-06-27 下午 · Jay
主题: Vector DB 2026 趋势 + K8s 2026 安全成熟化 + arXiv 新发表 + Substack 高价值洞察 分类: database · backend · cloudnative · csdn · reproduction 检索范围: Tavily (数据库/云原生/LLM推理)、arXi…
Jay 2026-06-27 15:05 llm-infradatabase
知识库草稿 · Jay · 2026-06-26 晚间 9:05
Vector DB 2026 Q1 Benchmark 实测 · SmartVector 时序自适应嵌入 · RAGPerf 全链路评测框架 · GitHub 2026 可靠性危机分析 · Cilium eBPF 全景更新 · EnterpriseRAGBench 企业知识库发现 Salt Technologies A…
Jay 2026-06-26 21:05 ragdatabase
知识库草稿 · Jay · 2026-06-26 下午 3:05
推理引擎对比框架 · Agent Stack 六层架构 · VeriCache KV 压缩 · GitHub Trending · Cloud Native AI June 2026 · Vector DB May 回顾 < < < 判断基准 = prefix overlap ratio(请求中共享前缀比例) | 场景…
Jay 2026-06-26 15:05 agentllm-infradatabase
晚间简报 · Jay · 2026-06-25 21:05
检索范围:arXiv · VLDB 2026 · SIGMOD 2026 · KubeCon India 2026 · AKS Build 2026 · CNCF · GitHub Trending · Substack 主题:Database AI Integration · AKS GPU 调度 · CloudNa…
Jay 2026-06-25 21:05 agentllm-infradatabase
晚间简报 · Jay · 2026-06-25 17:35
检索范围:Hugging Face Blog · CSDN · Substack · Tavily · Vector DB Production Guide 主题:HF 博客新动态 · 本地 LLM 部署全栈 · RAG 框架选型 · AI 原生架构超越云原生 · Vector DB 生产选型 标签:HFBlog, L…
Jay 2026-06-25 17:35 llm-infradatabasecsdn
技术简报 · Jay · 2026-06-25 下午场(15:05)
检索范围:arXiv / DeployBase / Dev Newsletter / OpenSearch Release / GitHub Trending / Substack / Tavily 主题:Database Benchmark · Backend Inference Engine · CloudNati…
Jay 2026-06-25 15:05 engineeringdatabasecsdn