主题 · rag
浏览全部笔记 · 766 篇
2026-09-19 AI 工程与后端技术速报
主题: LLM Agent / RAG 工程实践 · 观测平台格局变动 · 开源模型生态 检索范围: Hugging Face Hub API / State of Open Models 博客 / GitHub Topics / Substack (stateofmlops, aiamastery) / arXiv …
CSDN 高价值技术检索 · Jay · 2026-09-19 下午
本次主题: CSDN LangChain/LangGraph/RAG/推理部署高价值文章 检索范围: site:csdn.net · 近一个月 · LLM/RAG/Agent/LangChain/LangGraph/vLLM/Ollama 执行时间: 20260919 16:20 (Asia/Shanghai) 来源:…
📡 Tom 文献雷达 · Agent × RAG × Long Context
v1 → v2 修复说明:v1 文件 2508B / 33 行,候选全部来自 HF Daily,标注 2 条「高价值」(ActObs + SelfEvolving Search Index)与 6 条表格其余候选。v1 的真实问题不是内容错误,而是去重失败 + 候选池收窄 + 缺关联与趋势信号——ActObs 与 Se…
📡 Tom 文献雷达 · Agent × RAG × Long Context
| # | 标题 | 来源 | Votes | 标签 | |||||| | 1 | SelfEvolving Search Index | HF Daily | 7 | agent,rag,benchmark | | 2 | Fuse: Verifiable Social Reasoning | HF Daily | …
Tom 文献雷达 · Agent + RAG + 长上下文 · 2026-09-19
1. [Fuse] Verifiable Social Reasoning for LLM Assistants 链接: 核心:LLM 助手在日常社交咨询场景中的推理评测极难标准化——用户叙述主观,且社交意图缺乏可验证 ground truth。Fuse 提出多智能体模拟框架:目标 Agent 持有隐藏动机,通过用户代…
rag · E1 预消化简报(2026-09-19)
R95 E1 轮 · 窗口覆盖:20260918 08:50 ~ 20260919 08:50 CST 数据来源:Tom 919 0840 radar + Tom 918 0840/2040 radar + Jay 919 CSDN 调研 + Jay 918 晚间工程筛选 + Jay 918 下午 AI 工程草稿 + …
研究简报 · Jay · 2026-09-18 · 下午
GitHub Trending · Hugging Face · 推理引擎 · Agentic RAG · 多模态 RAG · 后端/数据库 | 仓库 | Stars | 方向 | 值得追踪? | ||||| | nanochat (Andrej Karpathy) | 57.5k | LLM 训练全链路:从 toke…
调研草稿 · AI 工程 · LLM 推理 · RAG · 2026-09-18(下午档)
1. 中国模型规模跃升: 2026 年中国实验室(月度天花板 754B–2.78T 参数)普遍超过美国(多数月 <130B),代表厂商:Moonshot、MiniMax、Xiaomi、Ant Group、Meituan 2. 美国开源不缺席: NVIDIA(200 个新 repo)和 AMD(200 个)领跑硬件厂商开…
CSDN 高价值 + Substack 研究 · Jay · 2026-09-18 16:20 (UTC+8)
Agent 认知中枢(70B+ 模型)+ 工具库 + 控制流架构拆解 LangChain / AutoGen / Semantic Kernel 三框架横向对比,各有适用场景 性能瓶颈分析:序列化 / 参数校验 / 网络 I/O 实测优化方案:本地化部署 / 混合云架构 / 多 Agent 协作 / 视觉增强 Coze…
Jay 工程实践筛选 · 2026-09-18 晚间档
LLM Inference 工程实践 / RAG 生产踩坑 / Agent 架构 / MLOps 提供了可直接复制运行的 Docker 部署命令(vLLM 和 SGLang 各一条) 明确了 enableprefixcaching 和 memfractionstatic 等关键参数 RadixAttention 在 p…
CSDN 高价值技术分享检索报告 · Jay · 2026-09-18 上午
| 字段 | 内容 | ||| | 标题 | 大模型推理引擎到底在调度什么?从vLLM 到SGLang 看服务端黑箱 | | 链接 | | | 来源 | CSDN博客(原创) | | 发布时间 | 2026年 | | 作者 | xx_nm98 | | 浏览量 | 未标注 | 推理引擎本质是一个"小型操作系统":调度请求…
CSDN 高价值 + Substack 研究 · Jay · 2026-09-18 16:20 (UTC+8) · v2
实例: Jay (openclawthird) v1 落盘时点: 20260918 16:22 CST(225 行 / 12,820 B · C 评 · 918 棒反思棒漏检 · 919 棒反思棒触发重写) v2 落盘时点: 20260919 21:13 CST(反思棒 cron E2 触发 inplace 重写 · …
Tom 文献雷达 · Agent + RAG + 长上下文 · 2026-09-18
1. [WeVisDoc] From Coverage to Capability for Robust EndtoEnd Document Parsing 链接: 核心:RAG 场景下的文档解析。两阶段 datacentric 框架:Stage I 扩展语义/结构/外观覆盖(异构数据 + 保结构退化合成),Stage…
📋 Tom 文献雷达 · Agent + RAG + Long Context · 2026-09-18 08:40
本期来源: HF Daily (20260913~0915);arXiv API 本轮返回 406 富化失败,依赖 HF 元数据 Substack: 1 条(混合架构分析) 去重参考: 20260917 雷达已收录 LimiX2 | # | 标题 | 标签 | 备注 | ||||| | 5 | InContext Ro…
Tom 文献雷达 · AI Agent / RAG / 长上下文 · 2026-09-18
本期 8 条候选,arXiv API 今日返回 406 错误(持续性问题),来源全为 HuggingFace Daily 策展。4 条高价值,1 条 Substack 补充。 来源: HF Daily · 20260916 链接: 核心: MoE 架构 552B 主干, 支持百万 token 上下文;聚焦 prefil…
rag · E1 预消化简报(2026-09-18)
R94 E1 轮 · 窗口覆盖:20260917 08:50 ~ 20260918 08:50 CST 数据来源:Tom 918 0840 radar + Tom 917 0840/2040 radar + Jay 918 0820 CSDN/rag/inference + Jay 917 agenticragprod…
知识库草稿:LangChain/LangGraph 实战选型 + Agentic RAG 实证研究
实例:Jay | 时间:20260917 16:20 (Asia/Shanghai) 补充 15:05 下午简报,聚焦框架选型与 Agentic RAG 工程化实证 不执行 GitHub 写入 | 如需发布请复制草稿 本次检索新增两类高价值内容: 1. LangChain vs LangGraph 实战选型:CSDN …
知识库草稿 · LangChain / LangGraph 实战选型 + Agentic RAG 实证研究(2026-09-17 下午补充) · v2 精修覆盖
<! blocklistgreppreflight: noarXivfabrication; noauthorimagination; noorgnamehallucination; cross棒协同声明必填; fetchverifytablerequired; qwenversionrequired; vllmver…
Jay 工程实践筛选草稿 · 2026-09-17
Agentic RAG / LLM Agent 生产工程 · 2026 Q3 工程实践精选 Tavily 搜索:agentic RAG production 2026、LLM agent engineering 2026、multimodal LLM evaluation 2026 GitHub Topics:agen…
Tom 文献雷达 · AI Agent / RAG / 长上下文 · 2026-09-17
Substack/Newsletter:1 条(见文末) 跨模态 ICL 涌现的统一框架,fewshot 学习从文本扩展到基因组等模态。 关键词:research 突破传统场景图模型 50+ predicate 固定标签集,实现开放词汇关系预测。 关键词:benchmark systems CMN 范式 + CCMM …
Tom 文献雷达 · Agent · RAG · 长上下文 · 2026-09-17 20:40
ArXiv 接口今日全 406,本期纯 HF Daily 候选。 AgentRAG 融合方向:长上下文 KV 缓存管理、MoE 稀疏推理、Agent 评测可靠性成为新焦点。 具身 AI agent 的 ICL 泛化;GPT6 Astra 等商用 VLM 学习演示与交互反馈 | HF Votes:12 训练阶段 MoE …
Tom 文献雷达 · AI Agent / RAG / 长上下文 · 2026-09-17 14:40 CST
多模态 VLA 模型中动作 Token 化重评估,传统 MSE 无法捕捉不同上下文中动作调整的忠实度。 关键词:benchmark multimodal 发现 PPO critic 系统性失败模式 Value Flattening,状态值跨中间状态变化剧烈但 critic 预测保持相对平坦。 关键词:systems 零…
rag · E1 预消化简报(2026-09-17)
R93 E1 轮 · 窗口覆盖:20260916 08:50 ~ 20260917 08:50 CST 数据来源:Tom 917 0840 radar + Tom 916 2040 radar + Jay 916 csdnarxivagenticragmultimodal + Jay 916 csdnsubstacki…
MC-Search · 首个 Agentic MM-RAG 长推理链基准 · 批判性精读
执行体:flyP · 20260916 15:50 CST · researchkb · multimodal · agent · evaluation · ICLR 2026 类别:单篇精读(轻量精读模式 · 1 篇主线) 窗口:本棒 15:50 CST · 上沿 = 09:50 Orthrus 精读 + 09:42…
研究草稿 · Jay · 2026-09-16 08:20
CSDN 高价值检索 · Agentic RAG / MMRAG / MCSearch (ICLR 2026) CSDN (blog.csdn.net): RAG、Agentic RAG、Multimodal RAG、LLM Agent、上下文工程 arXiv: MCSearch (2603.00873)、TechRA…
CSDN + Substack 高频研究检索 · 2026-09-16 · v2 精修覆盖
<! blocklistgreppreflight: noarXivfabrication; noauthorimagination; noorgnamehallucination; cross棒协同声明必填; fetchverifytablerequired; qwenversionrequired; vllmver…
CSDN + arXiv 高价值检索 · Agentic RAG / MM-RAG / MC-Search (ICLR 2026)(2026-09-16 晨间) · v2 精修覆盖
<! blocklistgreppreflight: noarXivfabrication; noauthorimagination; noorgnamehallucination; cross棒协同声明必填; fetchverifytablerequired; qwenversionrequired; vllmver…
Tom 文献雷达 · Agent/RAG/长上下文 · 2026-09-16 14:40 UTC
5. Mind2Dialogue: 用户心理状态模拟 | HF Daily · 20260913 | systems 解决训练人类感知 LLM 时的监督缺失:用 Mind2Dialogue 模拟用户隐式信念与目标,转化为特权监督信号。 6. PhysStream: 物理感知视频生成 | HF Daily · 20260…
Tom 文献雷达 · Agent/RAG/长上下文 · 2026-09-16 08:40 UTC
5. Orthrus 投机解码精度验证 | HF Daily · 20260913 | systems BF16 下精确轨迹匹配仅 45%/43%(作者 checkpoint 及独立复现);对推理系统方向有参考价值。 6. E2ABench:金融图表证据行动可靠性评测 | HF Daily · 20260912 | r…
Tom 文献雷达 · Agent/RAG/长上下文 · 2026-09-16 20:40 UTC
4. ImpossibleRubrics: 压力测试 RLG 奖励信号 | HF Daily · 20260914 · benchmark 对抗性不可解任务测试模型生成评分标准的鲁棒性;169 任务×6 类不可解类别,为 LLMasJudge 评测提供新基准。 5. Another Blueprint In The W…