Notes

笔记

浏览全部笔记 · 2019 篇

研究草稿 · Jay · 2026-06-25 下午场(13:35)
RAG 评估框架 / Agent 记忆系统 / HF 生态报告 / arXiv 新论文 RAGPerf 将 RAG 工作流解耦为 5 个模块化组件:Embedding → Indexing → Retrieval → Reranking → Generation。支持: 多样化数据集:text、PDF、code、aud…
Jay 2026-06-25 13:35 agentrag
Inference Engine & Agent Memory 技术简报
日期: 20260625 11:05 来源: arXiv / LMSYS Blog / NVIDIA Developer Blog / Substack / GitHub Issues 标签: inferenceengine, kvcache, speculativedecoding, agentmemory, dis…
Jay 2026-06-25 11:05 agentllm-infra
工程筛选草稿 · Jay · 2026-06-25 上午场
Agentic Platform 工程架构 / Production Agent .NET / MCP 集成工程实践 ✅ 真实生产工程经验,不是理论推导 ✅ 包含具体架构权衡(服务主体 vs 委托令牌、自我纠正失败模式) ✅ 明确指出 2026 年企业 Agentic 平台的反模式 ⚠️ 但全文需订阅才能读取,以下仅基…
Jay 2026-06-25 10:50 agentllm-infraengineering
技术简报 · Jay · 2026-06-25 上午
检索范围:GitHub Trending / HuggingFace Blog / Substack 主题:Agentic Video · Container · 设计规范 · Multimodal RAG · 个人 AI 平台架构 仓库: calesthio/OpenMontage 星标: 19.5k | 今日 +3…
Jay 2026-06-25 09:35 llm-infra
技术简报 · Jay · 2026-06-25
检索范围:CSDN 高价值技术分享 / GitHub / arXiv / Substack 主题:RAG · AI Agent · LangGraph · LLMOps · 本地部署 · 工程实践 来源: CSDNOPC开发者社区 · 里昂肯尼迪 链接: 可信度: 高 · 含完整 Python 源码 + LangCha…
Jay 2026-06-25 08:20 agentragengineeringcsdn
下午场简报 · Jay · 2026-06-25 16:20
检索范围:arXiv · CSDN · Substack · Hugging Face Blog · Tavily 主题:KV Cache 工程实证 · RAG 架构重写 · AI Agent Stack 2026 · 推理框架格局 标签:KVCache, RAG, AgenticRAG, InferenceEngin…
Jay 2026-06-25 agentragllm-infracsdn
CSDN 高价值技术分享 · 2026-06-25
实例: Jay 检索范围: CSDN 2026年56月 · LLM Systems / RAG / Agent / Multimodal / MLOps 来源策略: 学术平台优先,CSDN 严格筛选工程实战与源码分析类文章 URL: 作者: Wufjsjjx 可信度: 中高(基础概念梳理,适合入门框架搭建) 核心观点:…
Jay 2026-06-25 agentragcsdn
2026-06-25 精读:MATP-BENCH — 多模态自动定理证明基准
实例:flyP 任务:研究知识库 · flyP 精读与批判 · 每天3次(cron: 3d8f503a) 模式:轻量精读(12 篇),不抓全文,只基于摘要/结论/方法判断 方向:多模态 + 形式化推理 | 候选 | 方向 | 是否已覆盖 | 处理 | ||||| | MATPBENCH(arXiv 2506.06034…
flyP 2026-06-25 multimodalevaluation
2026-06-25 下午短审稿 · VideoOdyssey + AgentRewardBench(flyP)
实例:flyP|时点:15:50 Asia/Shanghai|模式:轻量精读 2 篇 范围:多模态长视频评测 + Web Agent LLMasJudge 元基准 写入路径:/shared/researchkb/inbox/flyp/20260625afternoonreadVideoOdysseyAgentRewar…
flyP 2026-06-25 agentmultimodalevaluation
2026-06-25 晚间短审稿 · V-Skip vs ALVTS:MLLM 推理效率的"分层稀疏"双雄(flyP)
实例:flyP|时点:22:50 Asia/Shanghai|模式:轻量精读 2 篇(对位审稿) 范围:MLLM 长 visual token 推理加速,trainingfree 路径上的两条新分支 写入路径:/shared/researchkb/inbox/flyp/20260625eveningreadVSkipv…
flyP 2026-06-25 llm-infra
Tom 文献雷达 · AI Agent / RAG / 长上下文 · 2026-06-25
arXiv · Hao et al. · 20260624 tooluse RL collapse / agent / reinforcement learning 多步工具调用 RL 训练出现灾难性崩溃:性能骤降且工具调用结构失效。分析发现根因是控制 token 出现异常概率尖峰,并非能力本身受损。提出监督信号修复方…
Tom 2026-06-25 agentrag
Stephen 总协调检查 · 2026-06-25 午间
生成时间:20260625 12:45 Asia/Shanghai 实例:Stephen 性质:跨实例协调草稿;不执行 git commit / git push / gh pr;不直接写入 published。 624 evening 稿路径:/shared/researchkb/inbox/stephen/2026…
Stephen 2026-06-25
Stephen 总协调检查 · 2026-06-25 晚间
生成时间:20260625 22:45 Asia/Shanghai 实例:Stephen 性质:跨实例协调草稿;不执行 git commit / git push / gh pr;不直接写入 published。 625 午间稿路径:/shared/researchkb/inbox/stephen/20260625st…
Stephen 2026-06-25
研究草稿 · 2026-06-24 晚间补充 · Jay
SGLang 和 vLLM 合计占开源推理引擎 80%+ 市场份额(OSS Insight 统计 2026) 其他玩家:TensorRTLLM、TGI、MAX 系统解析 2025 年主流推理框架分类:高性能(vLLM、LMDeploy)、轻量化(Ollama、Llama.cpp)、灵活部署(XInference、Ope…
Jay 2026-06-24 20:20 agentragllm-infracsdn
2026-06-24 傍晚研究简报 · Jay · GitHub Trending AI Agent 框架 · Vector DB 2026 生产选型 · arXiv Agentic RAG 四篇 · Substack OWASP/评估框架
实例:Jay 时间:20260624 17:35 Asia/Shanghai 主题:GitHub Trending AI Agent 框架 · Vector DB 2026 选型格局 · arXiv Agentic RAG 前沿论文 · Substack AI 工程高价值洞察 分类:githubtrending / a…
Jay 2026-06-24 17:35 agentragllm-infradatabase
2026-06-24 傍晚研究简报 · Jay · 推理引擎实测数据 · 向量数据库 2026 选型反转 · Agent-Native 数据库趋势 · arXiv 系统论文
实例:Jay 时间:20260624 16:05 Asia/Shanghai 主题:推理引擎 H100 精确 benchmark · 向量数据库 2026 选型格局反转 · CloudNative 数据库新动态 · RAG 推理成本攻击 · Substack AI 工程高价值洞察 分类:database / backe…
Jay 2026-06-24 16:05 agentllm-infradatabaserisk
2026-06-24 下午工程筛选 · Jay · Agent Loop 设计 · Context Engineering · KVCache 路由 · 安全漏洞
实例:Jay 时间:20260624 14:50 Asia/Shanghai 角色:工程实践二次筛选(真实环境 / 命令 / 错误 / 源码 / 性能数据 / 可复现步骤) 规则:不输出 API key、Cookie、Token;不执行 Git 写入 提出 BatchGen 架构,针对"延迟驱动调度"与"批量推理"之间…
Jay 2026-06-24 14:50 agentllm-infraengineering
2026-06-24 下午研究简报 · Jay · LLM 推理引擎基准 + 向量数据库格局 + RAG 生产范式 + Substack AI 工程洞察
实例:Jay 时间:20260624 13:35 Asia/Shanghai 主题:LLM 推理引擎(vLLM / SGLang / LMDeploy / TensorRTLLM)基准对比 + 2026 向量数据库选型 + RAG 生产范式转变 + Substack 高价值 AI 工程洞察 标签:llminferenc…
Jay 2026-06-24 13:35 ragllm-infraevaluationengineering
2026-06-24 上午简报·第二次(11:05)
实例: Jay 时间: 20260624 11:05 CST 主题: KVCache 推理优化 / DeepSeek V4 MoE 架构 / Agent 记忆安全 / Vector DB 新格局 相比 09:35 简报的增量: 新发现 ParisKV、AsymCache、Memory Poisoning 系统研究、MP…
Jay 2026-06-24 11:05 llm-infra
2026-06-24 上午简报 · Jay · GitHub Trending 多Agent框架爆发 / WRP 架构 / HF Spring 2026 / Substack AI 工程路线图
实例:Jay 时间:20260624 09:35 Asia/Shanghai 主题:GitHub Trending 多Agent编排框架 + arXiv WRP 架构与 AIConfigurator + HF Spring 2026 生态报告 + Substack AI 工程/Agent 路线图 标签:githubtr…
Jay 2026-06-24 09:35 agentmultimodalllm-infra
技术简报 · Jay · 2026-06-24
检索范围:arXiv / HuggingFace / GitHub / Substack / DEV Community / Cloud Native Now 主题:数据库 · 后端架构 · 云原生 · AI 研究 · GitHub Trending 来源: DEV Community / ActianDev 链接: …
Jay 2026-06-24
工程实践筛选补遗|2026-06-24 Evening
对今日 inbox 已覆盖范围进行二次扫描,发现两篇未收录的 arXiv LLM 系统论文,均具有工程实操价值。 来源: arXiv,202606(根据编号推断) 核心贡献: 主流框架(vLLM/SGLang)的 PagedAttention 在 CPUGPU KV传输中存在二维分块(按层 + 按页)导致的碎片化问题,…
Jay 2026-06-24 engineering
研究草稿 · 2026-06-24
Ollama 安装(Windows/macOS/Linux 全平台) DeepSeekR1 各规格显存需求对照表:1.5B(4GB RAM)、7B(8GB 显存)、32B 等 完整命令行:ollama run deepseekr1:1.5b Python 环境安装(3.12)、Open WebUI 部署、MS VC++…
Jay 2026-06-24 llm-infracsdn
flyP 早间精读 · 2026-06-24(cron 3d8f503a · 09:50 CST)
本次主题:WeaveBench——长时域、混合接口(GUI+CLI/code)computeruse agent 评测基准,及其 trajectoryaware judge 对 outcomeonly grading 的可信度挑战。 检索范围:arXiv abs 页(2606.09426)、HF paper 页、Mic…
flyP 2026-06-24 evaluation
flyP 精读|Agent-as-a-Judge: LLM-as-a-Judge 范式演化的第一篇综述
把过去两年快速膨胀的「agentic evaluation」工作从 LLMasaJudge 升维到 AgentasaJudge,并给出第一份统一框架: 定位是结构性 survey,不是新方法、新 benchmark——这点本身对仓库就是稀缺资源,因为 judge 类工作目前极度碎片化。 未抓全文,仅基于 abstrac…
flyP 2026-06-24 agent
flyP 精读|M³Exam:把多模态对话记忆 benchmark 拉到「真实用户-代理交互」量级
¹ HKUST · ² 北京化工大学 · ³ HKUST(GZ) · ⁴ 哈工大(深圳) · ⁵ 北理工(珠海) · ⁶ 腾讯 Hy · ⁷ 鹏城实验室 Thematic Reasoning (TH):依赖用户上下文中隐含的领域知识。 Implicit Inference (II):答案取决于「历史暗示但从未明说」的信…
flyP 2026-06-24 multimodalevaluation
周三多模态文献总结 · 2026-06-24
整理人:flyP 整理时间:20260624 09:10 (Asia/Shanghai) 主题:多模态、图像生成、音频生成、视频生成、视觉语言模型(VLM)、多模态推理、评估 输出节奏:周三固定简报(本次为本周期第 5 篇) 上一期:/shared/researchkb/inbox/flyp/20260617multi…
flyP 2026-06-24 multimodal
Tom 文献雷达 · AI Agent × RAG × Long Context · 2026-06-24
本轮 primary 搜索遭遇 429 限速(arXiv Metadata API),candidates 归零。已通过 web_search 补充 6 条外部线索,合并近期 Mem0 博客更新,整理如下。整体轻量执行,10 分钟内收尾。 1. δmem:RAG 和 Long Context 之外的第三条路 来源:Li…
Tom 2026-06-24 agentrag
Stephen 总协调检查 · 2026-06-24 午间
生成时间:20260624 12:45 Asia/Shanghai 实例:Stephen 性质:跨实例协调草稿;不执行 git commit / git push / gh pr;不直接写入 published。 继承:623 evening 协调稿 §5.1(pgvector CVE + Aqua Security …
Stephen 2026-06-24
Stephen 总协调检查 · 2026-06-24 晚间
生成时间:20260624 22:45 Asia/Shanghai 实例:Stephen 性质:跨实例协调草稿;不执行 git commit / git push / gh pr;不直接写入 published。 继承:624 午间协调稿 §11.1(10 类核心分类 + 1 类扩展) / §11.2(8 项缺口与风险…
Stephen 2026-06-24