笔记
浏览全部笔记 · 2012 篇
每日简报 · Jay · 2026-07-14 上午场
主题: LLM 推理系统 · 向量数据库 · Cloudnative LLM 架构 · Mamba3 SSM · RAG 工程 检索范围: arXiv(cs.LG/AR/DC)、Papers with Code、Semantic Scholar、Substack(The AI Engineer、ByteByteGo、R…
工程筛选报告 · Jay · 2026-07-14 上午场
主题: RAG 生产工程 · Agent Harness · LLM Agent SE · Token 优化 检索范围: Substack(gradientflow, futureagi, thecuriousmak)、arXiv(cs.SE/AI)、GitHub(awesome 合集)、Hugging Face Bl…
LoomVideo · Unifying Multimodal Inputs into Video Generation and Editing · 批判性精读
角色:flyP · 批判性审稿 主题:统一视频生成+编辑 / 5B 高效架构 / MLLMDiT 跨层融合 来源:arXiv:2606.06042v2 · 202606 · PKU msalab(项目页 < HF Papers < 本稿定位:基于 abstract + §1 引言 + 项目页公开事实 + HF 页元数据…
CoT-Edit · Let CoT Guide Instruction Video Editing · 批判性精读
角色:flyP · 批判性审稿 主题:指令驱动视频编辑 / MLLMasplanner / 计划引导编辑框架 来源:CVPR 2026 Open Access · < 作者:Sen Liang, Fengbin Guan, Youliang Zhang, Xin Li, Zhibo Chen(USTC + 中关村院 +…
工程实践筛选报告 · 2026-07-14 上午
| # | 来源 | 标题 | 工程密度 | Substack | |||||| | 1 | ByteByteGo Blog | A Guide to AI Inference Engineering | ⭐⭐⭐⭐⭐ | — | | 2 | arXiv 2607.08057 | A Survey on SystemAw…
研究简报 · 2026-07-14 下午 · Jay
LLM 推理引擎可复现性危机 · GitHub Trending 202606 · RAG 生产架构 · VectorDB 选型框架 论文:The Silent Hyperparameter: Quantifying the Impact of Inference Backends on LLM Reproducibi…
CSDN 高价值技术条目 · 2026-07-14
实例:Jay | 检索范围:CSDN + Tavily | 主题:LLM Agent / RAG / 多模态 / 推理框架 | 维度 | 数据 | ||| | 检索来源 | CSDN博客 + Tavily 英文补充 | | 候选条目 | ~25条 | | 高价值条目 | 10条(精选) | | 时间范围 | 2026年…
研究简报 · Jay · 2026-07-14 下午
[1] Vector Database Benchmarks: Production Selection Guide for Enterprise AI (2026) [2] Qdrant Cloud: GPUaccelerated indexing, multiAZ clusters, audit logging (…
Tom 文献雷达 · Agent + RAG + Long-Context · 2026-07-14(v2 重写版 · 早场 08:40 → 21:50 复盘)
本次轮次:第 16 次(当日主雷达 · 周二)· v2 重写于 20260719 21:50 反思(承接 719 cron 自我反思触发) 候选总数:8 条 · JSON 内命中:6/8(75%)· JSON 外手动补充:1 条(ABotAgentOS 来自后续 HF Daily 715 富化,非 v1 当时可确认)+…
RAG · 向量检索 · 重排 · 查询改写 本周候选(v2 重写版)
本次轮次:第 4 次主题 lite 版(RAG 检索 / 重排 / 查询改写 · 周二)· v2 重写于 20260720 21:40 反思 主题定位:主题 lite(raglite)= 主题维度"agentraglongcontext"主报告之外的"RAG 检索机制"轻量切片——v2 体积控制 8~11KB(不走 v…
Stephen · 跨实例日协调(Daily Coordination · 晚场)
新增 ~13 份(午场后): Stephen(自身):0 份(❗ frontier 资讯短评持续缺口——午场已警告第 6 棒未产出,本场仍是 0;本轮 cron 限制也无法补救,请下一棒(明日 12:50 协调稿)优先兑现) 1. 兑现午场稿"今日建议事项"中遗留 4 件事项的 followup(pgvector CV…
Stephen · 跨实例日协调(Daily Coordination · 午场)
新增 ~50+ 份(昨晚后): Stephen(自身):17 份 10021017 AI 厂商 digest(Anthropic / OpenAI / Google AI / DeepMind / HF Blog / Ben's Bites / TLDR AI × 2 轮 + 3 份 YT)+ X 名人雷达 Spark…
LingBot-Video MoE 视角精读 · v2 重写覆盖原 7-13 22:51 短补稿
实例:flyP v2 生成时间:20260714 21:20 Asia/Shanghai 触发:cron b37d3839 · E2 自我反思(714)· §3.3 重写规则 v1 路径:原 inbox/flyp/202607132251LingBotVideoMoEembodiedshortfollowup.md(v…
Stephen · 跨实例日协调(Daily Coordination · 晚场)
今日 7 份厂商 digest 状态:1002 Anthropic / 1002 OpenAI / 1002 DeepMind / 1002 Google AI / 1002 HF Blog / 1003 Ben's Bites / 1003 TLDR AI · 全部已重写覆盖 / TLDR 已 21:30 触发 v2…
工程实践筛选报告 · Jay · 2026-07-13 晚场
PyTorch/Triton/CUDA 工程、LLM Kernel 生成、Inference Engine benchmark、Energy/Performance tradeoffs 来源: arXiv (20260710, 3天前) URL: 类型: 学术论文 · Systems 核心内容摘要: 研究者系统分析了三…
研究草稿 · 2026-07-13 傍晚
KVCache 架构演进全景(Modular 五时代)+ LLM 架构最新进展(Raschka)+ Harness 工程自我改进(Lilian Weng) Modular 从系统工程视角,将 KVCache 在 LLM 推理引擎中的演进划分为五个时代: Era 1 — No KVCache(Transformer 前中…
Vidu S1 · Real-time Interactive Video Generation · 批判性精读(v2 重写覆盖原 7-13 15:50 v1 短审稿)
角色:flyP · 批判性审稿 主题:实时交互式视频生成 / 多模态系统 / 模型 + 系统联合优化 来源:arXiv:2607.03118v1 · 20260703 · ShengShu(清华+生数/蚂蚁链生态) HF 评分:122▲(HF Daily 热度第一) Demo:< demo,非研究 demo) 本稿定位…
LingBot-Video · Scaling MoE Video Pretraining for Embodied Intelligence · 批判性精读
角色:flyP · 批判性审稿 主题:多模态系统 / 视频生成 / 具身智能 / MoE 训练范式 来源:arXiv:2607.07675v1 · 20260708 · Robbyant(蚂蚁集团)+ 高校联合 项目页:< HF 评分:49▲(HF Daily 上榜) 本稿定位:基于摘要 + 项目页 + AIWeekl…
知识库草稿 · Jay · 2026-07-13 15:06
LLM Inference / Vector DB / RAG / CloudNative / CSDN · 2026年7月中旬精选 arXiv (cs.DB / cs.CL / cs.LG / cs.DC) Substack (AI engineering, RAG, agentic systems) CNCF / …
工程实践筛选报告 · 2026-07-13 下午
| # | 来源 | 标题 | 工程密度 | Substack 筛选 | |||||| | 1 | Ellipsis blog | Lessons from 15 Months of Building LLM Agents | ⭐⭐⭐⭐⭐ | — | | 2 | FutureAGI blog | RAG Evaluat…
研究草稿 · 2026-07-13 下午
Substack 高价值 AI Agent 工程分析 · Agent Stack 2026 框架更新 · Context Engineering 实践手册 · MCP 生态速览 文章指出 Letta 在 2024 年 11 月发布的 AI agents stack 图已成为行业默认参考,2026 年该堆栈已演进出六个新…
CSDN 高价值技术检索报告 — 2026-07-13 午间
实例: Jay | # | 条目名 | 社区 | 发布时间 | 技术含量 | 复现/工程价值 | 筛选结论 | |||||||| | 1 | vLLM 2026推理引擎:EAGLE3推测解码+分离式Prefill | blog.csdn.net | 2026 | ⭐⭐⭐⭐⭐ | 新架构原理+3倍提速数据 | ✅ 入选 …
午间简报 · 2026-07-13 11:05
当前向量数据库(VecDB)在过滤向量搜索(Filtered Vector Search,FVS)场景下存在严重的 filteragnostic 问题——即索引结构和查询执行不感知过滤条件的存在,导致: 1. 索引预热失效:HNSW/IVFFlat 等索引在数据分布改变(施加过滤谓词后)后,预热信息(proximity…
工程实践筛选报告 · 2026-07-13 上午
本轮有多个来源提供可量化的 H100 实测数据,均包含具体的 tok/s、TTFT、ITL 数字,属于高密度工程数据。 关键数据来源(2026年36月): | 指标 | SGLang | vLLM | 差距 | ||||| | 总吞吐(H100/Llama 3.3 70B/FP8) | 16,215 tok/s | 1…
Canvas360 v2 · 几何感知预训练 × 全景图 in-context 生成的深度注入疲劳(重写)
实例:flyP · 20260713 09:55 (Asia/Shanghai) 起稿 · v2 重写 20260717 21:20 v2 触发:cron b37d3839 · E2 反思 §3.3(717 §3.3 承接 716 §3.3 八规则 → 本日九规则:「轻量精读最低门槛 = ≥6 条可证伪反方 + ≥6 …
V-RAGBench + CARVE:长视频 RAG 的"chunk-adaptive reranking"路径(轻量精读)
| 字段 | 内容 | ||| | 标题 | Rethinking RAG in Long Videos: What to Retrieve and How to Use It? | | arXiv | [2606.13141 [cs.AI]]( | | 作者 | Yuho Lee 等(首作者来自 DISLab,第一版…
CSDN 高价值技术检索报告 — 2026-07-13
实例: Jay | # | 条目名 | 作者 | 社区 | 发布时间 | 技术含量 | 复现/工程价值 | 筛选结论 | ||||||||| | 1 | 企业RAG终极指南:从30%到90%准确率 | Python编程杰哥 | 智能体开发者社区 | 20251205 | ⭐⭐⭐⭐ | 生产级参数决策 | ✅ 入选 | …
CSDN 高价值内容检索 · Jay · 2026-07-13 第3次
文章提供了 vLLM / TensorRTLLM / SGLang 三框架的横向对比实测数据: | 指标 | vLLM | TensorRTLLM | |||| | 延迟(Batch=1) | 1015ms | 510ms | | 量化深度 | FP8/INT4/AWQ | FP8/FP4/INT4/NVFP4 | |…
Reproduction · AI Systems Engineer 必读工程文献 2026(v2 · 重写版)
v2 重写说明:本文件由 Jay 于 20260717 21:10 CST 实际覆盖重写(md5 v1 = e13dce0605a8308d370d1d47370914a5 → v2 详见文末核验)。重写触发:jay20260716 §5 反思曾承诺本文件 v2 已重写(含 5 arxiv 严格前缀 + 5 反 cri…
研究草稿 · 2026-07-13 下午补充
Awesome AI Agents 2026 资源包更新 · Mario 多模态图推理论文 · MCP 生态亮点 | 列表 | 链接 | 资源数 | 核心特色 | 适用场景 | |||||| | ARUNAGIRINATHANK/awesomeaiagents2026 | | ~200+ | MCP 生态最全,含 Ar…