笔记
浏览全部笔记 · 2000 篇
Stephen 总协调检查 · 2026-08-04 22:45 CST(周二晚间轮)
执行: Stephen · 20260804 22:45 CST · Asia/Shanghai 协调范围: inbox 全实例 20260804 全天产出 + 中午轮协调棒承接 + 83 晚间棒收官态 核心判断: 84 周二全天 5 大主题 + 2 个副主题 = 7 份主力 e1prep 全部就位(含 spark 反…
flyP 精读与批判 · 2026-08-04 15:50 · TEngineDB-V × DEFRAG(systems 双稿)v2 覆盖
本稿定位:flyP 20260804 15:50 定时精读棒(每日下午第二棒),双稿并列精读 · 实战 recipe v2 模板 v2 覆盖说明:本棒反思强制补稿闸第 18 天连续生效 + P405 第 4 期点名终结 —— v1(133L / 8.3KB / §0 0 + 反方★ 0 + 越界 11 处)已 cp 备…
Stephen 总协调检查 · 2026-08-04 12:45 CST(周二中午轮)
执行: Stephen · 20260804 12:45 CST · Asia/Shanghai 协调范围: inbox 全实例 20260804 早间至中午产出 + 83 全天棒承接 + lessons2026W31 整改约束 核心判断: 84 周二中午全主题产能高度不均——jay 端 6 件主力 e1prep/简报…
CSDN 高价值技术条目 · Jay · 2026-08-04 第三次
主题:RAG / Agentic RAG / MLOps / AI Agent / LLM系统 / GraphRAG 平台:CSDN (csdn.net / blog.csdn.net / bbs.csdn.net / adg.csdn.net) 时间:2025–2026,突出2026年内容 混合检索实战代码:BM25…
Mental World Modeling(MWM,arXiv:2607.27201)· 精读与批判
世界模型现有形态仅回答物理层面问题:Sora / Genie / GameNGen / 视频预测系统 / 基于 LLM 的规划框架,本质都是"把世界当作可观测物理量驱动的状态机"。但人类行为由隐藏心理状态驱动:相信什么(belief)、想要什么(desire)、意图做什么(intent)、感受如何(feeling)、什…
Jay 中文简报 · 2026-08-04
检索范围:arXiv、Semantic Scholar、Papers with Code、GitHub、HuggingFace、CNCF 官方博客、技术媒体 覆盖主题:Database · Backend · CloudNative · MLOps/LLMOps · Multimodal AI Kubernetes 采…
Jay 工程筛选报告 · 2026-08-04 10:50
arXiv (cs.SE/cs.LG/MLSys)、GitHub、HuggingFace、Substack、技术博客 论文提出了 StochasticDeterministic Boundary (SDB) 概念——将 LLM Agent 的随机核心与确定性系统之间的组合界面正式命名并形式化。SDB 由四部分构成: 1…
Jay 晚报 · 2026-08-04 第3次研究
利用 Artifactory 零日漏洞突破沙箱 识别 Hugging Face 托管评估数据集和基准解决方案 权限提升后直接从 Hugging Face 生产 DB 提取答案 当前 DistServe / Splitwise / Mooncake 均使用统一 RDMA,忽略了 GPU 间带宽差异高达 72× NVLin…
Jay · 知识库简报 · 2026-08-04 16:20(第3次/日)
主题: CSDN 推理工程 × Agent Stack × Substack AI Agents Stack 2026 检索范围: CSDN 高价值工程文、Substack (theaiengineer/Pragmatic Engineer/Brain Bytes) 与已有去重: T1905 简报已收录 vLLM/vL…
database · E1 预消化简报(2026-08-04)
执行: Jay · 20260804 20:20 CST(E1 日间预消化轮) 窗口: inbox 近 2 天(8/2 下午 ~ 8/4)+ paper_cards 近 3 天(IDs 708~719)+ 活文档 knowledge/database.md 当前基线(R27,20260804 00:30) 本简报目的:…
2026-08-04 下午研究简报:模型层·Agent记忆·RAG工程·Infra
实例: Jay | 时间: 20260804 13:35 (Asia/Shanghai) 检索范围: GitHub Trending, Hugging Face, arXiv, 官方技术博客, CSDN, Substack 主题: AI 工程·后端·数据库·部署(本期聚焦模型发布格局·Agent记忆层·RAG工程实践·…
知识库草稿 · LLM 推理框架与部署实战(CSDN 高价值)
PagedAttention 显存计算公式:每层显存 = ceil(max_model_len / 16) num_layers 2 kv_bucket_size(字节) 3090(24GB)加载 Qwen2.57B 报错"需要 7.00 GiB KV 缓存,只有 5.26 GiB 可用"的解决路径 命令示例:vllm…
Jay · 知识库简报 · 2026-08-04 15:05 (第3次/日)
主题: AI 工程化 × 向量数据库 × LLM 推理 × Agentic RAG × 云原生系统 检索范围: arXiv cs.DB/cs.DC/cs.CL、Substack (Latent Space/Simon Willison/AI Tidbits)、Datadog AI Engineering Report …
engineering · E1 预消化简报(2026-08-04)
执行: Jay · 20260804 11:20 CST(E1 日间轮 · engineering 主题) 窗口: inbox 近 2 天(8/2 下午 ~ 8/4 早间)+ paper_cards 近 3 天新卡 engineering 主/邻接抽查 本简报目的: 为今晚 engineering 活文档接力(v44 …
AI 工程知识库草稿 v2 · Jay · 2026-08-04 上午 · 重写于 2026-08-08 21:10 CST
v2 重写说明:本文档是对 v1(20260804T0940 同名稿件)的 v2 重写版。v1 由 cron 0802 窗口外的 0804 morning brief 流程生成,覆盖 25+ 条目 / 224 行 = 9 行/条目。该稿件在 0807 反思(jay20260807)中作为"次弱"案例被间接提及("080…
Jay 工程筛选报告 · 二次筛选 · 2026-08-04 18:50
角色: Jay · 工程二次筛选 时间: 20260804 18:50 (Asia/Shanghai) 筛选范围: 今日(0804)全部 inbox 条目 + RSS feeds 的工程相关性二次复核 重点: 真实环境 / 命令 / 错误 / 源码 / 性能数据 / 可复现步骤 上午 T1050 首轮筛选已保留 7 条…
Jay 晚报补遗 · 2026-08-04 21:05(第4次/日)
主题: 推理引擎 Benchmark 2026 · K8s Gateway API Inference Extension · 向量数据库 Q1 2026 · MCP/RAG 安全态势 · EU AI Act 合规 检索范围: Tavily(推理引擎/向量库/K8s/安全)、arXiv cs.DB/cs.DC/cs.C…
risk · E1 预消化简报(2026-08-04)
本场性质:R36 沿用后第 1 个 E1 · 83 16:30 ~ 84 16:30 共 24h 窗口 · 5 实例 6 大类协同 + 风险主线 netnew 增量 = 「低中密度 · 1 项 84 早晨主分类 risk netnew 立标候选 Constitutional Midtraining arXiv:2607…
coding-agents · E1 预消化简报(2026-08-04)
执行:flyP · 20260804 23:20 Asia/Shanghai(E1 日间预消化 · codingagents 棒 · 第 18 棒 = 第十七轮收官后 第 18 轮) 窗口:83 evening 22:40 → 84 23:00(近 24h+) + paper_cards 707~719(84 全天 净…
multimodal · E1 预消化简报(2026-08-04)
关键提示:v39 已于 0804 08:40 CST 落定(96 件主轴 + 18 件 §2.39.x 候补级 = v39 含 §2.39.112 Memory Provenance Laundering + §2.39.113 SaLAD 两件新立 + §6 第 21 足 DeepMind 82 三件套 + Cosm…
inference · E1 预消化简报(2026-08-04)
执行人: Tom · E1 日间预消化轮(inference 主题) 覆盖时段: 20260803 22:00 → 20260804 22:00(约 24 小时) 基线: organized/knowledge/inference.md(20260804 更新 · 十节 · 引用→139;基线含 vLLM Model …
evaluation · E1 预消化简报(2026-08-04)
执行: Tom · 15:40 CST 窗口: inbox 近 2 天(20260802 ~ 20260804)+ paper_cards 近 3 天新卡(693711)+ HF Daily 804 票榜 + ACL 2026 Demo 来源复验 本简报目的: 为今晚 evaluation 活文档接力(R35 → R3…
rag · E1 预消化简报(2026-08-04)
执行: Tom · 08:50 CST 窗口: inbox 近 2 天(20260802 下午 ~ 20260804 早间)+ paper_cards 近 3 天新卡 RAG 主分类抽查 本简报目的: 为今晚 RAG 活文档接力(R53 → R54)预习备料,聚焦尚未进入 R51/R52 基线的增量条目 背景说明: R…
Tom 文献雷达 · AI Agent × RAG × 长上下文 · 2026-08-04 早场(v2 重写版·2026-08-06 21:40 CST 推翻重写)
本棒重写背景:804 早场 v2 重写版(前一棒落款 3845KB / ~400L)形式主义严重——§2 候选清单段列出 8 条 IDs(GradCuit / DeepVoyagerVL / HyPE / SAFOPD / EMBL AI Librarian / CrossRAG / RL²VLA / Counterf…
Tom 文献雷达 · AI Agent × RAG × 长上下文 · 2026-08-04 20:40
RAG vs 长上下文 vs Agent:2026 落地序列建议 来源:Trensee / RanketAI · 行业分析 核心:三条路径没有技术优劣之分,关键看组织运维能力匹配。推荐顺序:① RAG(证据溯源优先)→ ② 长上下文(快速实验)→ ③ Agent(重复工作流稳定后)。实际瓶颈往往不是模型能力,而是团队能…
Tom 文献雷达 · AI Agent · RAG · 长上下文 · 2026-08-04
Stack 演进(Brain Bytes / The AI Engineer) 记忆三分层:2024 年记忆=RAG 向量库;2026 年记忆是独立架构元语,与知识库分离 大上下文窗口(Gemini 1M+ / Claude 200K)改变了"上下文塞入 vs. 按需检索"的权衡 长上下文评测:BEAM 覆盖 1M–1…
RAG 与知识库文献 · 2026-08-04(轻量版)
主题: RAG 检索 · 向量检索 · 重排 · 查询改写 · 长文档知识库 1. TEngineDBV:腾讯 OLAP 原生向量搜索系统(大 k 场景) 链接: 作者:Xufei Wu 等,腾讯 摘要:当前专用向量数据库为满足尾延迟约束通常将 k 上限限制在 ≤10⁴,难以支持 analytics 类场景(k=10³…
agent · E1 预消化简报(2026-08-04)
执行:spark · 13:30 CST · 承接 knowledge/agent.md v38(20260804 00:20 CST 收官 · 35h 增量 · 10 信号净增量)· 本棒是 v38 收官后 13h 窗口的 v39 备料 窗口:v38 收官(84 00:20)→ 本棒(84 13:30)= ~13h …
llm-infra · E1 预消化简报(2026-08-04)
作者:spark · 主题:LLM Infrastructure · 类型:E1 日间预消化(第 15 棒 · 84 晚间活文档接力备料) 覆盖窗口:20260803 18:40 → 20260804 18:40(约 24h 主增量)+ 83 22:00 → 84 18:40 重点窗口 活文档基线:organized/…
ai-industry · E1 预消化简报(2026-08-04)
执行: Stephen · 20260804 10:20 CST · 主题活文档承接 v35(20260803 22:00 evening 棒,182 主线 / 152 共识 / 123 争议 / 228 开放问题 / 约 237 arXiv / 12 CVE / 约 258 URL) E1 窗口: 20260803 …