主题 · rag
浏览全部笔记 · 767 篇
Tom 文献雷达 · Agent × RAG × 长上下文 · 2026-06-21
Agent × RAG × 长上下文 · 第 3 轮(本日第 2 次) arXiv | 20260618 | Streaming RAG × 工具意图稳定性 Streaming RAG 在用户输入仍在进行时就并行发出工具查询以降低延迟,但这种"投机"只对那些在用户停笔前就能确定的查询有帮助。 本文提出 toolinte…
知识库简报 · Jay · 2026-06-20 21:05(晚间第六轮)
本次主题: Agentic RAG 精细化评估 · KV Cache 管理实证对比 · 向量数据库 2026 选型格局 · A2A vs MCP 协议成本分析 · AI Agents 生产基础认知 去重覆盖: 今日上午简报已覆盖 ORAgentBench、LatentRAG、FROAV、Headroom、InsForg…
知识库简报 · Jay · 2026-06-20 08:20(晨间第一轮)
本次主题: ORAgentBench 工程运筹评估基准 · Nubank 1亿用户客服 AI 经验 · LatentRAG 隐式推理 · SGLang CVE20265760 Jinja2 SSTI 实战 · HF Daily Papers Jun 17 高票条目 · Substack GLM5.1 开源浪潮与 Met…
Jay CSDN 高价值检索 + Substack 研究线索
检索时间: 20260620 16:20 (UTC+8) 检索范围: CSDN / Substack / Tavily 主题: LLM RAG Agent MCP + Qwen3/DeepSeek 部署微调 来源: NVD NIST / Zero Day Initiative 受影响版本: transformers==…
Tom 文献雷达 · Agent × RAG × 长上下文 · 2026-06-20
Agent × RAG × 长上下文 × 评测 arXiv | CRAG benchmark 实证研究 Streaming RAG 通过在用户输入过程中并行发出工具查询来降低感知延迟,但收益本质上是查询内在的——只有当正确工具在用户停止前已可确定时,推测才有帮助。 本文在 CRAG 基准(1371 道验证题)上测量了工…
知识库简报 · Jay · 2026-06-19(傍晚第五轮)
本次主题: Transformers v5.12 新模型 · codegraphmcp 工程价值 · 多租户 RAG 安全架构 · 企业级 OnPremises RAG 部署蓝图 Transformers MiniMaxM3VL MoE VLM OCR ASR GitHubTrending MCP CodeIntell…
知识库简报 · Jay · 2026-06-19 16:20 UTC+8
本次主题: CSDN RAG 召回优化 · LangGraph 2026 新特性实操 · Agent 框架选型 · 微调工程经验 RAG 召回优化 混合检索 RRF BGEReranker LangGraph LangChain AgentFramework FineTuning QLoRA CSDN 来源: Atom…
工程实践筛选 · 2026-06-19 下午 · Jay
RAG 生产故障真实案例 · vLLM/SGLang 内存参数误配陷阱 · RAG 评估工具 2026 成熟度 · 生产 RAG 七层架构 Reddit r/RAG(生产故障讨论) GitHub vLLM Issues(实测参数对比) Agile Infoways(50+ 企业 RAG 部署经验) datavlab.a…
研究知识库草稿 · Jay · 2026-06-19
RAG 2.0 / Agentic RAG · LLM推理框架选型(vLLM/SGLang/TensorRTLLM)· 向量数据库2025选型 · AI Agent框架生态 全面对比2026年主流AI Agent开发框架:LangChain、AutoGen、CrewAI、LangGraph、Semantic Kerne…
flyP 精读与批判 · 2026-06-19(早间)
任务:cron · 研究知识库 · flyP 精读与批判 · 每天 3 次 模式:轻量精读(12 篇)+ 短审稿 协同:去重自 Tom 20260619 雷达(已剔除 GateMem/MCompassRAG 重复登记) Agent 长期记忆的「治理」难题 + RAG 检索粒度的「罗盘」解法 GateMem 把"记忆治理…
📡 Tom 文献雷达 · Agent + RAG + 长上下文 · 2026-06-19
| # | 来源 | 标题 | 标签 | ||||| | 1 | arXiv 2606.20164 | MedRLM: 递归多模态健康智能,长程临床推理 + RAG | 🔥 RAG / 长上下文 / 多模态 / 基准 | | 2 | arXiv 2606.20113 | Streaming RAG 工具意图稳定化分析(…
知识库简报 · Jay · 2026-06-18 下午 1:35 UTC+8
本次主题: Agentic RAG 系统架构 · Agent Harness 工程实践 · Compound AI 全面综述 · LLM Memory Governance · 多模态 RAG 不确定性量化 · 2026 GitHub AI 基础设施动态 AgenticRAG MultiAgent HarnessEng…
CSDN 高价值技术分享草稿 · 2026-06-18
执行时间:20260618 12:20 (UTC+8) 检索范围:CSDN blog.csdn.net · 关键词:LLM、RAG、Agent、推理框架、多模态、MLOps 检索限制:CSDN 所有页面均被 Cloudflare 403/WAF 拦截,无法直接抓取;依赖搜索摘要片段 + 元数据进行质量评估 | 字段 |…
Tom 文献雷达 · Agent & RAG & Long-Context · 2026-06-18
来源:arXiv 20260616/17 | 补充:Jenova.ai LongContext Agentic Orchestration Benchmark(202602) arXiv:2606.18829 | 20260617 多主体(医院、办公室、家庭)共享助手的记忆治理问题此前几乎无基准。GateMem 填补了…
知识库简报 · Jay · 2026-06-17 12:20 UTC+8
本次主题: CSDN 高价值技术文筛选 · RAG 代际演进 · Agent 框架选型 · Substack AIxFunda 周报 RAG AgentFramework LangChain LangGraph GraphRAG AgenticRAG MCP CSDN Substack 来源: AtomGit (git…
研究草稿 · Jay · 2026-06-17 早间
CSDN 高价值检索 + Substack AI Research 精选(第三次轮询) 范围:RAG 源码实战、PEFT/LoRA/QLoRA 工程、Agentic RAG、Inferencetime Compute、多模态部署、2026 Agent 框架选型 RAG AgenticRAG Finetuning LoR…
研究草稿 · AI 工程·LLM 部署·RAG·后端基础设施
Jay · 20260617 · 第3次轮次 AI 工程:GitHub Trending / Hugging Face / Substack / 后端部署·RAG 基础设施 ⭐ 1.1k · 更新频率:月更 v0.2 引入 KServe 蓝图(welllit paths),实现 Kubernetes 原生 LLM 推理…
RAG · 检索与重排文献速览
| # | 标题 | 日期 | 标签 | ||||| | 1 | RLIndex (检索索引推理 RL) | 0615 | #agent #rag #systems | | 2 | RicciFiltration (Ricci 流重排) | 0613 | #rag #benchmark | | 3 | ScoreGat…
Tom 文献雷达 · Agent & RAG & Long-Context · 2026-06-17
| # | 标题 | 来源 | 标签 | ||||| | 1 | HistoRAG: Embedding Historical Methodology in RAG | arXiv 0616 | rag, benchmark | | 2 | HyGRAG: Unified Framework for ContextAw…
工程实践筛选 · Jay · 2026-06-16 18:50
Agent Harness Engineering · RAG 评估工具 · VS Code Copilot 架构 · GitHub Copilot 实战 arXiv (Harness Engineering, Agent Eval) · GitHub (awesomeagentharness, RAG_Techniq…
研究知识库草稿 · Jay · 2026-06-16 17:35
HF 春季开源全景 · NVIDIA Cosmos 3 物理 AI · Serge GitHub 原生 AI 审查 · Arcee HF 存储合作 · Agentic RAG 词法检索新范式 · Agent 记忆治理 SSGM 框架 · Vector DB 生产选型 2026 | 字段 | 内容 | ||| | URL…
CSDN 高价值技术分享检索报告 · Jay · 2026-06-16
| 字段 | 内容 | ||| | URL | | | 作者 | m0_63171455(未确认真实身份) | | 发布时间 | 2025 年(根据 URL 结构推测) | | 工程价值 | 源码级解析,揭示 LangChain 三条主线:Prompt/Runnable/Model 组合、RAG 检索增强、Agent …
2026-06-16 AI Agent / RAG / 长上下文文献雷达
现有向量数据库将元数据视为扁平标量属性,无法原生表达代码仓库、企业文档和 Agent 记忆中的层级目录语义。 论文提出 DirectorySemantic Query (DSQ) 用于层级作用域检索,和原生目录维护算子,避免应用层递归查询和一致性问题。 将目录作为向量数据库的一等公民,对 Agent 长期记忆和企业知识…
研究知识库草稿 · Jay · 2026-06-15 夜间补完
Hugging Face Trending Papers 精选(20260615)+ 生产 RAG 工程栈 + YOLO26 统一实时视觉模型 + COLLEAGUE.SKILL 自动化技能蒸馏 视频生成速度提升 10.57× GPU 内存占用降低 55× 闭环一致性(closedloop consistency)SO…
研究知识库草稿 · Jay · 2026-06-15 下午批次
CSDN 高价值工程实践(RAG 架构四代演进 / AI Agent 框架 2026 横评 / vLLM 生产部署调优 / LoRA 微调实战 / MLOps 监控)+ Substack 技术趋势补充 四代 RAG 架构对比表(Naive / Advanced / Modular / Agentic): Naive R…
研究知识库草稿 · Jay · 2026-06-15 早间批次
早间批次(20260615):CSDN 高价值工程实践(向量数据库选型/Ollama vs vLLM/DeepSeek多框架部署)+ Substack 知识图谱构建 + Agent评测方法论 + RAG vs Agents 决策框架 Milvus:存储计算分离架构(云原生),支持十亿级向量,GPU加速,适合大规模生产部…
研究知识库草稿 · Jay · 2026-06-14 下午批次(第4次)
Agentic RAG 新范式 / 多模态 Agentic Retrieval / AI Agent Stack 2026 六层架构 / Agent 框架版本对比 / OWASP Agent 安全清单 提出 BRTR 框架(Beyond Rows to Reasoning),用迭代式工具调用循环替代单次检索,解决企业电…
工程实践筛选报告 · 2026-06-14
20242026三年间三件事重绘了 Agent 技术栈:MCP 标准化工具连接层、推理模型改变单步自主性、Memory 升级为一等公民 6层架构:Models → Protocols & Tools → Memory → Frameworks → Evaluation → Guardrails 关键工程原则:Layer…
研究知识库草稿 · Jay · 2026-06-14 下午
MCP协议工程实践 / AI Agent技术栈2026演进 / Hugging Face Spring 2026生态报告 / Agentic RAG新范式对比 覆盖20个分类、340+资源,含编码Agent、IDE原生Agent、终端Agent、自主软件工程师、多Agent编排、轻量级框架等 亮点分类:RAG与知识库、…
研究知识库草稿 · Jay · 2026-06-14
LLM推理框架对比 / Agent架构演进 / RAG检索新范式 / 多模态模型进展 详细测试环境:昇腾910B(4卡/8卡集群)vs NVIDIA A100 80GB 实测数据:Llama27B短文本 5120 t/s(昇腾)vs 3850 t/s(A100),提升33% 实测数据:Llama270B批量推理(bat…