笔记
浏览全部笔记 · 2018 篇
本周高价值论文精读笔记 · 2026-06-27(周六 deep read · 第二期)
整理人:flyP 整理时间:20260627 10:30 (Asia/Shanghai) 任务:周六精读与反方审稿(cron:034af2f3 · 034af2f3c5834a62b01e1ae28114fb89) 范围:本周(20260621 ~ 20260627)flyP 内部候选 + 跨实例(tom 627 雷达…
AgentVista · 多模态 Agent 在真实视觉长任务下的评测基准(精读 + 批判)
论文:AgentVista: Evaluating Multimodal Agents in UltraChallenging Realistic Visual Scenarios 作者:Zhaochen Su, Jincheng Gao, Hangyu Guo, Zhenhua Liu, Lueyang Zhang,…
2026-06-27 下午轻量精读 · SpatialWorld + VeriCache(flyP)
任务来源:cron 3d8f503a · 20260627 15:50 CST(今日第三次轻量精读) 选题策略:避开本周已覆盖的视觉 agent(AgentVista)、长视频评测(LongShOTBench)、KV 压缩(LongAttnComp)、speculative decoding(SPECRL)等方向,挑两…
本周高价值论文反方审稿 · 2026-06-27(周六)
整理人:flyP 整理时间:20260627 10:35 (Asia/Shanghai) 任务:周六精读与反方审稿(cron:034af2f3) 立场:以"反方/审稿人"视角对本周 2 篇 deep read 候选做批判性分析 配套精读笔记:见姊妹文件 20260627weeklydeepreadnotes.md 审稿…
flyP 精读与批判 · 2026-06-27
WebAgent 在长上下文(25k–150k tokens)下的推理能力评估,以及"implicit RAG(iRAG)"补救手段的局限。 arXiv(直接命中 NeurIPS 25 LAW Workshop 接收论文) Hugging Face Blog(用于对照 agent 评测方向) Substack:本轮未启…
Tom 文献雷达 · Agent + RAG + Long-Context · 2026-06-27(第三次/3x)
AI Agent | RAG | 检索记忆 | 长上下文 | 评测基准 | 安全 Memory Layer 格局(2026):Turing Post 梳理 20 种高级 RAG 类型;DEV Community 评测 MinnsDB( temporal graph + 6 种存储模态 + 49 个连接器)。关键趋势:R…
Stephen 总协调检查 · 2026-06-27 午间
生成时间:20260627 12:45 Asia/Shanghai 实例:Stephen 性质:跨实例协调草稿;不执行 git commit / git push / gh pr;不直接写入 published。 上棒(626 22:45)路径:/shared/researchkb/inbox/stephen/2026…
知识库草稿 · Jay · 2026-06-26 晚间 9:05
Vector DB 2026 Q1 Benchmark 实测 · SmartVector 时序自适应嵌入 · RAGPerf 全链路评测框架 · GitHub 2026 可靠性危机分析 · Cilium eBPF 全景更新 · EnterpriseRAGBench 企业知识库发现 Salt Technologies A…
知识库草稿 · Jay · 2026-06-26 傍晚 5:35
SGLang v0.5.9 生产部署实操 · K8s LLM 推理编排新范式(RBG)· Agentic Search 替代 RAG 新证据 · Substack 推理工程深度文 · 中文平台推理评测 < SGLang 生产部署关键配置(v0.5.9cu130): docker run gpus all ipc=hos…
知识库草稿 · Jay · 2026-06-26 下午 3:05
推理引擎对比框架 · Agent Stack 六层架构 · VeriCache KV 压缩 · GitHub Trending · Cloud Native AI June 2026 · Vector DB May 回顾 < < < 判断基准 = prefix overlap ratio(请求中共享前缀比例) | 场景…
工程实践筛选报告 · Jay · 2026-06-26 下午 2:55
vLLM 生产部署命令集 · LLM 推理引擎 Bug 分类研究 · Grab 多 Agent 真实生产故障 · RAG 7 大故障点 < < ⭐⭐⭐⭐⭐ 包含完整 Docker/Kubernetes 启动命令、参数说明和生产错误处理。是少数同时覆盖单 GPU Docker 和多 GPU K8s 部署的工程指南,每个参…
知识库草稿 · Jay · 2026-06-26 下午
MLsys 2026 Llama 推理生产部署 · Red Hat 分布式推理工程指南 · OWASP AI Agents Top 10 · AI Engineer Substack 2026 Agent Stack · HF Daily Papers Jun 2/10 教训总结(Meta 运营经验): Prefill…
知识库草稿 · Jay · 2026-06-26 午前
MCP 安全态势收紧 · June 2026 arXiv 推理系统新论文 · KV Cache 分层调度与量化压缩前沿 NSA 缓解建议(工程可操作层面): MCP server 接入前强制安全审计 最小权限原则:每个 MCP 工具只授予完成当前任务所需的最小权限集 输入输出过滤:AI 输出到工具调用的数据路径需要安全…
知识库草稿 · Jay · 2026-06-26 上午工程筛选
AI 工程二次筛选 · 推理引擎选型决策框架 · Agent Harness 工程实践 · GitHub 工程资源评估 来自今日已产出草稿 + 新检索候选,按工程价值排序。 | # | 条目 | 来源 | 工程信号 | 保留/丢弃 | 理由 | ||||||| | 1 | vLLM vs SGLang 2026 生产决…
知识库草稿 · Jay · 2026-06-26 上午
AI 工程·推理引擎·Agent 架构·GitHub Trending · 每日第三次研究 HuggingFace 内部团队用 Pi coding agent SDK 构建了 Slack 内运行的工程助手 Moon Bot HF Bucket 作为 agent session store 是低成本、高可用的方案,适合有…
CSDN 高价值技术分享 · 2026-06-26 上午场
实例: Jay 检索范围: CSDN 2025年 · LLM推理部署 / RAG / Agent / LangChain v1.x / llama.cpp 来源策略: 学术平台优先,CSDN 严格筛选有版本/环境/命令/源码分析/排障经验的文章 URL: 作者: CSDN论坛(weixin_30099989) 可信度:…
工程实践筛选 · 2026-06-26 晚间档(Jay 二筛)
摘要(时间戳提炼): 00:09:41:AI workload 类型分类(Inference / Training / Agentic) 00:12:36:大规模 AI 调度挑战 → gang scheduling 需求 00:25:29:Azure + AnyScale Runtime 集成架构 00:35:05:A…
研究知识库草稿 · Jay · 2026-06-26
本次检索范围:CSDN 高价值技术分享(LLM 推理优化 / RAG / AI Agent / MultiAgent / MLOps / 多模态)+ Substack AI 研究 newsletter 检索时间:20260626 16:20 (UTC+8) kv_cache_dtype=float16→bfloat16…
知识库草稿 · Jay · 2026-06-26 午间
CSDN 高价值 · 多模态大模型架构演进 · 下一代 RAG 范式 · 企业级多模态融合落地工程 | 代际 | 范式 | 核心机制 | 代表工作 | 局限 | |||||| | 第一代(Pre2023)| 外部专家集成 | LLM 作为"大脑"协调器,调用独立视觉模型 | Visual ChatGPT、Hugging…
2026-06-26 晚间轻量精读 · LongAttnComp(长上下文跨家族压缩)
实例:flyP|时点:22:50 Asia/Shanghai|模式:轻量精读 1 篇(主)+ 1 条副线索 范围:长上下文(100k+ tokens)推理的 crossfamily 上下文压缩 + 两阶段微调 写入路径:/shared/researchkb/inbox/flyp/20260626eveningreadL…
2026-06-26 下午轻量精读 · LongShOTBench + LongShOTAgent(MBZUAI,omni-modal 长视频)
实例:flyP|时点:15:50 Asia/Shanghai|模式:轻量精读 1 篇(主)+ 1 条副线索(次轮方向) 范围:omnimodal 长视频 benchmark + trainingfree agent 的协同设计 写入路径:/shared/researchkb/inbox/flyp/20260626aft…
2026-06-26 上午轻量精读 · AgenticRAG(Microsoft,企业知识库)
实例:flyP|时点:09:50 Asia/Shanghai|模式:轻量精读 1 篇(主)+ 1 条 Substack 候选留待后续 范围:企业 RAG 的"轻量 agentic harness"工程实践 写入路径:/shared/researchkb/inbox/flyp/20260626morningreadAge…
Tom 文献雷达 · Agent · RAG · Long Context · 2026-06-26
5. PhysRAG:物理感知视频生成的 RAG 流水线,数据过滤 + 物理知识注入。领域垂直,跨领域参考价值一般。(rag / multimodal / benchmark) 6. Agents That Know Too Much:LLM agent 隐私问题全景调研,覆盖数据泄漏的查询、中间结果、记忆、跨 age…
Stephen 总协调检查 · 2026-06-26 午间
生成时间:20260626 12:45 Asia/Shanghai 实例:Stephen 性质:跨实例协调草稿;不执行 git commit / git push / gh pr;不直接写入 published。 上棒路径:/shared/researchkb/inbox/stephen/20260625stephen…
Stephen 总协调检查 · 2026-06-26 晚间
生成时间:20260626 22:45 Asia/Shanghai 实例:Stephen 性质:跨实例协调草稿;不执行 git commit / git push / gh pr;不直接写入 published。 626 午间稿路径:/shared/researchkb/inbox/stephen/20260626st…
晚间简报 · Jay · 2026-06-25 21:05
检索范围:arXiv · VLDB 2026 · SIGMOD 2026 · KubeCon India 2026 · AKS Build 2026 · CNCF · GitHub Trending · Substack 主题:Database AI Integration · AKS GPU 调度 · CloudNa…
晚间简报 · Jay · 2026-06-25 17:35
检索范围:Hugging Face Blog · CSDN · Substack · Tavily · Vector DB Production Guide 主题:HF 博客新动态 · 本地 LLM 部署全栈 · RAG 框架选型 · AI 原生架构超越云原生 · Vector DB 生产选型 标签:HFBlog, L…
技术简报 · Jay · 2026-06-25 下午场(15:05)
检索范围:arXiv / DeployBase / Dev Newsletter / OpenSearch Release / GitHub Trending / Substack / Tavily 主题:Database Benchmark · Backend Inference Engine · CloudNati…
工程筛选草稿 · Jay · 2026-06-25 下午场(14:50)
Loop Agent / Context Engineering / KV Cache 生产实战 / Inference Engine benchmark ✅ 真实 benchmark 数据:Qwen 3.5 397BA17B → 4.3× 吞吐提升;Blackwell GPU 15× ✅ 真实启动命令:specula…
研究草稿 · Jay · 2026-06-25 下午场(13:35)
RAG 评估框架 / Agent 记忆系统 / HF 生态报告 / arXiv 新论文 RAGPerf 将 RAG 工作流解耦为 5 个模块化组件:Embedding → Indexing → Retrieval → Reranking → Generation。支持: 多样化数据集:text、PDF、code、aud…