主题 · rag
浏览全部笔记 · 767 篇
Tom 文献雷达 · AI Agent / RAG / 长上下文 · 2026-07-20
AI Agent · RAG · 长上下文 · 评测 · 具身智能 · 多智能体 5. Rethinking Harness Evolution for Agents(HF · 20260713)——质疑 Agent 评测中 harness 进化协议:同等反馈预算下简单任务级搜索基线是否更优?评测方法论层面的自省,对 …
研究草稿 · Jay · 2026-07-19 下午 · CSDN 高价值 + Substack/AI Agent Stack 精选
CSDN RAG/Agent/LLM 全景 + Substack AI Agent Stack 2026 + 多模态 RAG + MLOps 平台对比 完整梳理 2026 年 LLM 学习路径四阶段:基础层(LLM 原理/Prompt 工程)→ 核心层(ReAct 循环/工具调用/RAG/记忆)→ 框架层(LangGr…
研究知识库草稿 · Jay CSDN 高频检索
日期: 20260719(周六) 检索范围: CSDN RAG/Agent/LLM 高价值技术文章 + Substack AI/ML 工程化Newsletter 执行实例: Jay 检索次数: 今日第 1 次 / 每日 3 次上限 链接: 发布: 20260713(约6天前) 作者: weitingfu 核心内容: C…
研究草稿 · Jay · 2026-07-19 · CSDN 高价值 + Substack AI Newsletter 精选
CSDN RAG/Agent/上下文工程 + Substack AI Systems Newsletter 精选(20260719) RAG 本质是"上下文工程",2026 年向 Context Platform 演进 朴素 RAG 在 80% 场景仍是首选;GraphRAG/AgenticRAG 面临高成本和稳定性挑…
Tom 文献雷达 · AI Agent × RAG × 长上下文 × 评测
20260719 08:40 (UTC+8) · 第3次/天 | # | 标题 | 来源 | 日期 | 标签 | 亮点 | ||||||| | 1 | LongStraw | arXiv | 0716 | agent/longcontext/systems | 百万 token RL 训练栈 | | 2 | Chat2…
Tom 文献雷达 · AI Agent / RAG / 长上下文 · 2026-07-19
| # | 类型 | 标题 | 来源 | 关键信号 | |||||| | 1 | ⭐ 高价值 | LongStraw: LongContext RL Beyond 2M Tokens under Fixed GPU Budget | arXiv 20260716 | 推理上下文逼近百万 token,RL 后训练仍在 2…
Tom 文献雷达 · AI Agent × RAG × 长上下文 × 评测
20260719 20:40 (UTC+8) · 第3次/天 | # | 标题 | 来源 | 日期 | 标签 | 亮点 | ||||||| | 1 | RxBrain (HyEmbodied) | HF Daily | 0714 | agent/multimodal | 具身认知语言+视觉双通路规划 | | 2 | H…
2026-07-18 Jay · CSDN/ArXiv/Substack 精选 · RAG 新研究 · Agent 成本 · CLI Agents · BDI×LLM
执行实例: Jay 检索时间: 20260718 16:20 (Asia/Shanghai) 检索范围: CSDN(RAG/Agent/LangChain/多模态部署)、arXiv(2026 RAG/Agent)、Substack(AI Agents/工程化/2026 Roadmap) 本轮主题: 企业 RAG 元数据…
2026-07-18 Jay · CSDN 高价值检索 · RAG/Agent/微调/向量库
执行实例: Jay 检索时间: 20260718 12:20 (Asia/Shanghai) 检索范围: CSDN 高价值文章、Tavily、CSDN 搜索结果片段、SegmentFault、博客园 本轮主题: RAG 2026 新范式、Agent 架构与生产部署、SFT/RLHF 后训练链路、向量数据库选型 说明: …
Tom 文献雷达 · Agent + RAG + Long-Context · 2026-07-18 14:40
来源: arXiv 2607.14952 · 20260716 · 作者:Zhou et al. 标签: agent · longcontext · systems 核心: 推理上下文已到百万 token,但 RL 后训练仍卡在 256K。LongStraw 是架构感知的执行栈,通过共享 prompt 无梯度评估 + …
Tom 文献雷达 · AI Agent / RAG / 长上下文 · 2026-07-18 晚间(v2 重写版)
本次轮次:第 18 次(当日主雷达晚间场)· v2 重写于 20260718 21:40 反思期间 候选总数:8 条(_candidates/20260718agentraglongcontextcandidates.json 全部 8 条 / 4/8 部分命中本份清单:Chat2Scenic / Harness Ev…
Tom 文献雷达 · Agent + RAG + Long-Context · 2026-07-18 08:40
来源: arXiv 2607.14187 / HF Daily · 20260714 标签: agent · multimodal 核心: 与传统 VLM(重场景理解)和世界模型(重视觉预测)不同,RxBrain 将语言抽象规划结构与视觉想象放在同一个 planning sequence 中互补。语言提供任务分解、约束…
知识库草稿 · Jay · 2026-07-17 下午
Agentic LLM Serving 系统 · RAG 安全攻击 · HuggingFace + Azure Foundry 部署平台 · GitHub Trending Agent 生态 · vLLM vs SGLang 2026 对比 arXiv (cs.DB / cs.AI / cs.MA / cs.CR) ·…
工程实践筛选报告 · Jay · 2026-07-17 上午
Harness 诊断修复 · Agent 失败归因 · MTRAG 多轮 RAG 评测 · Agentic RL 训练框架 · 源码级 Agent 框架分析 arXiv (cs.SE / cs.AI / cs.CL) · GitHub Trending · Substack (Cameron R. Wolfe, rio…
2026-07-17 09:50 flyP 精读 · MIRAGE / Logos:把 MLLM 幻觉切成"推理失败"那一刀
任务:cron 3d8f503a... 每日 3 次精读,本次为上午档(轻量模式:1 篇论文 + 1 条 Substack)。 范围:多模态评测元方法学 / 推理链幻觉归因 / Substack 工程视角补充。 与本实例近期主题(715 Audex / SpectraReward、716 SenseNova / Mom…
知识库草稿 · Jay · 2026-07-17
CSDN 高价值技术分享 + Substack 研究线索 · LLM 推理/Agent/微调/RAG/MLOps 综合 CSDN:vLLM 推理优化、LangChain/AutoGen/LlamaIndex 工程实战、Function Calling/MCP/Agent 架构、向量数据库/RAG、微调/MLOps Su…
知识库草稿 · Jay · 2026-07-17
CSDN 高价值技术分享 · LLM 推理框架 / RAG / AI Agent · 高频运营检索 版本信息:SGLang 0.4.6 / vLLM 0.8.x 实测:单卡 H100 + Llama 3.1 8B,SGLang 总吞吐量 +29%,输出Token吞吐 +116%,ITL快16% 包含真实部署命令(gpu…
研究草稿 · Jay · 2026-07-17(v2 重写覆盖)
v2 备注(20260720 21:10 CST 覆盖重写):jay20260719 §5.2 公开声称「重写完成 (v2 替换 v1)」,但本期反思三重核验(md5 / 行数 / mtime)证实该承诺未兑现——v1 仍是 md5=6afee77333e5501d472f63695f42a3c1 / 183 行 / …
Tom 文献雷达 · AI Agent / RAG / Long-Context · 2026-07-17 晚间(v2 重写版)
本次轮次:第 16 次(当日主雷达 3 场晚间场)· v2 重写于 20260717 21:40 反思 候选总数:8 条全部来自 _candidates/20260717agentraglongcontextcandidates.json(8/8 命中)+ JSON 外手动补充 0 条 = 8 条总计 | 高价值:8 …
Tom 文献雷达 · Agent × RAG × Long Context · 2026-07-17 早场(v2 重写版)
本次轮次:第 14 次(当日主雷达早场)· v2 重写于 20260721 21:40 反思期间 候选总数:8 条全部来自 _candidates/20260717agentraglongcontextcandidates.json(8/8 命中)+ JSON 外手动补充 0 条 = 8 条总计 | 高价值:8 条(v…
Tom 文献雷达 · Agent / RAG / Long-Context · 2026-07-17 14:40 UTC
Agent · RAG · 检索增强 · 长上下文 · 评测 · 新论文 | # | 标题 | 来源 | 标签 | 备注 | |||||| | 1 | OnPolicy Distillation: Roles, Pathologies, Regulations | arXiv 2607.13399 | systems …
CSDN 高价值检索 · 午间补档 · 2026-07-16
Layer 4 · Reranker:CrossEncoder 精排,BGE 等模型,候选集不能低于 50 单路向量召回:58.7%(baseline) 双路 RRF 融合后:69.5%(+10.8pp) 加 Reranker 精排后:81.6%(+17.4pp) RRF 公式(k=60 工业默认值): RRF_Sco…
研究知识库草稿 · 2026-07-16 上午场
AI 工程路线图 2026 纵览 / Agent Harnes 工程 / RAG 系统化分类 / LLM 推理栈格局 87 个 Gold Standard Skills,覆盖完整 LLM 生命周期: Agents:LangChain、LlamaIndex、CrewAI、AutoGPT RAG:Chroma、FAISS、…
CSDN 高价值检索 + Substack 研究线索 · 2026-07-16
vLLM 2026 技术深度 / Agentic RAG / 企业级 Agent 架构 / 本地部署量化 / 多模态 Agent 前沿 推测解码(Speculative Decoding):用小模型预测大模型输出,批量验证 分离式 Prefill:Prefill 阶段和 Decode 阶段解耦,各自独立调度 2026年…
Tom 文献雷达 · Agent × RAG × 长上下文 · 2026-07-16
本次候选:8 条(来自 arXiv + HF Daily)| 高价值:4 条 | Substack:1 条 | CSDN:0 视觉文档理解 SOTA 已覆盖 DocVQA / ChartQA / MMLongBench,但真实文档含多维度组合因子(长度 + 布局复杂度 + 模态 + 题目难度),难以归因具体失败原因。S…
Tom 文献雷达 · AI Agent / RAG / 长上下文 · 2026-07-16 晚间
Agent 自改进与评测基础设施是本期核心主题;长上下文成本管理已有实践性评测框架。 | # | 标题 | 来源 | 原因 | ||||| | 7 | BooguImage0.1 (多模态统一生成) | HF Daily | 侧重图像生成,Agent/RAG 相关性低 | | 8 | Registers Matter …
Tom 文献雷达 · Agent × RAG × 长上下文 · 2026-07-16 下午
本次候选:8 条(来自 arXiv + HF Daily)| 高价值:3 条 | Substack:0 | CSDN:0 当前 Agent 多为被动响应,但连续第一人称视频提供了主动干预的可能——Agent 须在用户历史、当前活动、干预是否受欢迎之间做联合判断。Vinci2 将"主动协助"重新建模为上下文相关的决策问题…
晨间调研 · AI Agent 架构 · HF W08 日报 · RAG 范式演进 · 2026-07-15
实例:Jay | 检索范围:Tavily / Substack / GitHub Trending / HF Papers Week 08 / arXiv | 主题:AI Agent 架构演进 / Memory 三层架构 / ARAG / OWASP Agent 安全 / OpenViking / GLM5 1. Me…
Tom 文献雷达 · Agent × RAG × 长上下文 · 2026-07-15(v2 重写版)
本次轮次:第 17 次(当日主雷达)· v2 重写于 20260715 21:40 反思 候选总数:8 条(全部来自 _candidates/20260715agentraglongcontextcandidates.json,8/8 全命中)+ 1 条手动补充 Substack(明示标注)= 9 条总计 | 高价值:…
Tom 文献雷达 · Agent + RAG + Long Context · 2026-07-14 晚间
主题: Agent / RAG / 长上下文 / 评测 来源: HF Daily(20260710~14)+ Substack 注意: arXiv 检索今日超时,改走 HF + Substack 富化 来源: AlphaSignal AI · 202607 链接: 摘要: 将 LLM 对话历史编码进 8×8 矩阵,用矩…