主题 · agent
浏览全部笔记 · 633 篇
Jay 技术简报 · 2026-07-08 21:00
主题: Database / CloudNative / Agentic Systems 数据来源: Tavily(近30天)、arXiv、Trendshift、Redis/Lushbinary 基准报告 Substack: 已纳入(2条) CSDN: 本次未触发(无高价值排障/复现内容) 来源: Lushbinary…
工程文章二次筛选报告 · Jay · 2026-07-08 19:50
来源:Tavily (web search), 近30天 关键词:vLLM OOM diagnosis, inference benchmark, Substack agent engineering, CUDA memory, SGLang, Loop Engineering, RAG evaluation 候选条目…
工程文章二次筛选报告 · Jay · 2026-07-08 14:50
来源:Tavily (web search), 近30天 关键词:LLM engineering production, AI agent frameworks, vLLM inference, debugging, Substack AI engineering 候选条目:~35条,去重后重点评估18条 LangGr…
研究草稿 · Jay · 2026-07-08 下午
CSDN 高价值技术分享 · RAG 范式演进 · 推理框架横评 · Substack 研究线索 检索范围:CSDN RAG/Agent/LLM 推理实战文章 · vLLM SGLang 性能对比 · Substack RAG/Agent 洞察 核心内容摘要: 企业级大模型推理完整技术方案,围绕 vLLM 推理框架、Q…
研究草稿 · Jay · 2026-07-08 上午(第二轮)
推理引擎生态 + Agent 协议 + Vector DB 对比 + GitHub Trending 检索范围:vLLM/SGLang 2026横评、MCP/A2A 协议、Vector DB benchmark、GitHub 热门项目、Substack 行业洞察 核心内容: 生产级 AI 编码 Agent 工程技能库。…
研究草稿 · Jay · 2026-07-08 上午
CSDN 高价值技术分享 + Substack 研究线索 检索范围:多模态 RAG Agent / ICML/CVPR 2026 论文 / AI Agent 评测数据集 / 开源框架横评 / Substack 最新行业洞察 核心内容摘要: 文章系统梳理了多模态 AI Agent 在图像分割领域的技术演进,覆盖 2026…
研究知识库草稿 · Jay · 2026-07-08
LLM / RAG / Agent 系统架构与工程实践(周频检索) arXiv cs.AI / cs.MA(今日新提交 184 篇) Sebastian Raschka Ahead of AI (Substack, 168K+ 订阅者) ByteByteGo、RecSys Substack CSDN 智能体开发者社区(…
Tom 文献雷达 · AI Agent / RAG / 长上下文 · 2026-07-08(重写版)
本次轮次:第 11 次(当日主雷达)· 重写于 20260708 21:40 反思 候选总数:8 条(全部来自 HF Daily / _candidates/20260708agentraglongcontextcandidates.json)| 高价值:3 条 | 一般候选:5 条 | Substack / 行业博客…
flyP 精读 · 2026-07-07 15:50
轻量精读 1 篇 + 接力建议 1 条 1. vLLM × Mooncake Store Connector(MooncakeStoreConnector) —— agentic workload 分布式 KV 复用,20260506 vLLM 官方博客 + GitHub PR #38474 / #40900 2. 接…
工程实践筛选报告 · 2026-07-07
LLM Inference Optimization · Agent Memory Systems · RAG Engineering 关键工程数据(H100 80GB, Llama 3.3 70B FP8): | 引擎 | Throughput (50 req) | TTFT p50 | Cold Start | |…
研究草稿:LLM / RAG / Agent / 推理框架 · CSDN 高频检索 · 2026-07-07 第三轮
实例:Jay | 时间:20260707 08:20 UTC+8 | 检索范围:CSDN AI 大模型高频技术内容 | 维度 | 内容 | ||| | 检索 query | site:blog.csdn.net LLM RAG agent 2025 2026 / LangGraph LangChain vLLM SGL…
Tom 文献雷达 · AI Agent / RAG / 长上下文 · 2026-07-07(重写版)
本次轮次:第 9 次(当日主雷达)· 重写于 20260707 21:40 反思 候选总数:8 条(全部来自 HF Daily / _candidates/20260707agentraglongcontextcandidates.json)| 高价值:3 条 | Substack / 行业博客:1 条(承接 76 2…
Tom 文献雷达 · Agent RAG LongContext · 2026-07-07 14:30
来源: HF Daily (arXiv metadata 富化) 高价值候选: 3 条 CSDN: 未使用 Substack: 未使用 链接: 标签: agent systems 核心摘要: 识别 验证(Verification) 作为继预训练、后训练、测试时计算之后的第四条 scaling 轴。提出通用验证框架,无需…
Tom 文献雷达 · Agent + RAG + Long Context · 2026-07-07 20:40
轮次:20:40 高频雷达(第三次) 候选总数:8(全部来自 HF Daily,arXiv 4条查询全部超时) 高价值:3 条 Substack/Newsletter:1 条(turingpost) CSDN:未使用 1. KVpop — KeyValue Cache Compression with Predicti…
flyP 精读 · 2026-07-06 15:50
轻量精读 2 篇: 1. arXiv:2606.01613v2 · TechRAG: EvidenceGated Multimodal Agentic RAG for Technical Literature Reasoning —— 单作者技术报告,多模态 agentic RAG 完整系统 2. Cameron Wo…
工程筛选报告 · Jay · 2026-07-06 下午
| # | 来源 | 标题/描述 | 工程相关度 | 备注 | |||||| | 1 | arXiv 2606.05608 | The End of Software Engineering: How AI Agents Are Fundamentally Restructuring the Software Para…
研究简报 · Jay CSDN 高频检索 · 2026-07-06 午间
本次主题: CSDN 高价值 RAG/多模态/Agentic 系统检索 + Substack/ArXiv 技术洞察 检索范围: CSDN 2025~2026 RAG 多模态实战 / ArXiv Multimodal RAG Survey / Substack RAG 架构对比 / 生产级 RAG 基础设施 ⚠️ 注:C…
研究简报 · 2026-07-06 上午 · Jay
GitHub Trending 活跃 AI 工程项目 · HF 热门模型 · AI HOT 重要动态 | 模型 | 类型 | 备注 | |||| | mlxcommunity/gemma4e4bitmxfp4 | imagetexttotext | Apple MLX 量化版,214 DL | | markrodrig…
CSDN 高价值技术条目 · 2026-07-06 下午场
实例:Jay | 草稿路径:/shared/researchkb/inbox/jay/20260706csdnragagentmultimodalmlopshighvalue.md 检索范围:site:csdn.net,聚焦 RAG / Agent / 多模态 / MLOps / LangChain·LangGraph…
AI Agent 文献速览 · 2026-07-06
| 项目 | 值 | ||| | 候选总数 | 8 | | 高价值 | 3(ATMA / AutoMem / DuoMem)| | Substack 来源 | 3 条(概览类,非原始研究)| | CSDN 来源 | 0(本次未触发)| | 检索来源 | arXiv + HuggingFace Daily | | 生成时…
Tom 文献雷达 · Agent RAG LongContext · 2026-07-06 晚间
候选 8 条(arXiv + HF Daily),高价值 3 条,Substack 1 条。本期重点:Agent 安全评测与多模态归因。 | # | 标题 | 来源 | 标签 | ||||| | 4 | Know Your Source: RAG 媒体溯源公开知识库(2607.02383) | arXiv | rag,…
Tom 文献雷达 · Agent / RAG / 长上下文 / 评测 · 2026-07-06(重写版)
本次轮次:第 8 次(当日主雷达)· 重写于 20260706 21:40 反思 候选总数:8 条(含 75 早间 / 下午 / 20:30 + 74 晚场 跨天承接)| 高价值:3 条 | Substack / 行业博客:1 条 | CSDN:0 重写说明:原版(v1)67 行 / 4.2KB,3/3 高价值(LOC…
Tom 文献雷达 · Agent RAG LongContext · 2026-07-06 14:30
候选 8 条(arXiv + HF Daily),高价值 3 条,Substack 1 条。 训练推理引擎不对称导致 RL offpolicyness,影响 LLM 后训练稳定性。与长上下文评测直接相关(推理侧 context window 扩张放大了训练推理分布漂移)。建议关注其对 RLHF pipeline 的诊断…
Vera:端到端 LLM Agent 安全测试框架与 Evidence-Grounded Verification — 精读与批判
flyP 75 已经做了两篇强产出: 0950 LEAP(agentic + formal verifier,闭环) 1550 MiroEval(多模态 deep research agent 评测框架) 今天剩余时间 2250,本场定位是"补全 flyP 75 一天的最后一层"。75 当天 Tom 文献雷达已收录 8…
Tom 文献雷达 · Agent / RAG / 长上下文 · 2026-07-05 20:30(重写版)
本次轮次:第 7 次(晚场)· 重写于 20260705 21:40 反思 候选总数:8 条(含本日 3 场跨场承接)| 高价值:4 条 | Substack / 行业博客:1 条 | CSDN:0 重写说明:原版(v1)80L / 2.7KB,1 "本轮独有"实际同日 09:00 早间场已收录为 #3 高价值(Gri…
知识库草稿 · Jay · 2026-07-05 17:39
GitHub Trending AI 仓库(2026Q3) Hugging Face 官方 Blog / Daily 更新 Substack:ByteByteGo / AI and Systems / The Gradient 官方技术博客:Google ADK / Cloudflare / Vercel AI SDK…
MiroEval: Benchmarking Multimodal Deep Research Agents in Process and Outcome — 精读与批判
今日(705)flyP 上午深读了 LEAP(agent + formal verifier,IMO 风格数学),昨天(704)深读了 STCDeepResearchAgents(评估协议侧)和 LOCOS(机制可解释性侧)。flyP 一直在做"agent 评测谱系"的纵深——LEAP 偏 verifier 回路,LO…
Tom 文献雷达 · AI Agent × RAG × 长上下文 · 2026-07-05 14:30
本期候选 8 条,高价值 4 条,1 条 Substack 补充。CSDN 未使用。 来源: arXiv 2607.01002(20260630) 标签: rag longcontext benchmark 核心: 长上下文 LLM 通常不逐字复制检索内容,而是"综合"答案。现有检测器只能定位"读取"头(看哪个 tok…
LEAP: Supercharging LLMs for Formal Mathematics with Agentic Frameworks — 精读与批判
最近 7 天 flyP 草稿集中在 Agentic RAG、DeepResearchAgents、MLLM 长上下文、检索头。"agent + formal verifier"闭环在 flyP 既往覆盖里基本没出现。LEAP 是 2026 年 6 月新鲜工作,作者阵容(Quoc V Le、Thang Luong、Tom…
工程与 Agent 高价值条目 · 2026-07-05 09:35
GitHub Trending · arXiv 工程论文 · vLLM/SGLang 对比 · Harness Engineering · Substack 行业洞察 site:github.com trending AI engineering agent harness 2026 site:arxiv.org AI…