知识库草稿:RAG / LLM / Agent CSDN 高价值内容 + Substack 线索

产出时间:2026-10-07 12:20 (Asia/Shanghai)

实例:Jay

主题

RAG 系统工程实践 · LLM Agent 架构选型 · 推理框架横评(CSDN 高价值检索)


一、CSDN 高价值条目(工程/复现价值)

条目 1|Agent 开发的五种架构范式及选型思路

  • 链接:https://blog.csdn.net/vitaviva/article/details/161141374
  • 作者:vitaviva
  • 发布时间:2026-05-18
  • 数据指标:926 阅读 / 19 点赞 / 21 评论
  • 核心内容:
  • ReAct 框架原理(思考-行动循环)
  • LangGraph 实现方案:工具定义、LLM 绑定、Agent 节点构建
  • 五种架构范式对比与选型场景分析
  • 工程价值:⭐⭐⭐⭐ | 提供了 LangGraph 实际代码结构,非纯概念
  • 复现价值:有代码示例,可直接复用
  • 涉及版本:LangGraph(需进一步核验具体版本)
  • 建议分类:Agent 架构范式 LangGraph ReAct
  • 后续行动:建议对比原版 LangGraph 官方文档,核验 API 是否有 Breaking Change

条目 2|2026年LLM Agent平台选型:五大方案横评与开发实践

  • 链接:https://blog.csdn.net/m0_69581581/article/details/166139719
  • 作者:m0_69581581
  • 发布时间:2026-09-20
  • 数据指标:64 阅读(较低)/ 1 点赞 / 2 评论
  • 核心内容:
  • 横评平台:SiliconFlow、Hugging Face、Fireworks AI、Uniphore、Seldon
  • Agent 开发核心矛盾:模型能力与工程复杂度错位
  • 各平台软件能力边界分析
  • 工程价值:⭐⭐⭐⭐ | 平台横评信息密集,有实测数据
  • 复现价值:需获取原文全文确认是否有可运行代码示例
  • 建议分类:Agent 平台选型 LLM 2026
  • 后续行动:阅读原文确认代码量和深度

条目 3|推理框架横评:vLLM / TGI / TensorRT-LLM / SGLang

  • 链接:https://blog.csdn.net/tpriwwq/article/details/(从搜索片段推断)
  • 作者:tpriwwq
  • 发布时间:2026-07-07
  • 数据指标:538 阅读
  • 核心内容:
  • vLLM:通用场景稳健
  • SGLang:RadixAttention 在 Agent/JSON 场景领先
  • TensorRT-LLM:性能最优但工程复杂
  • TGI:与 HF 生态深度集成
  • lmdeploy:专注国产化需求
  • 工程价值:⭐⭐⭐⭐⭐ | 生产级性能测试,有延迟/吞吐/显存对比
  • 复现价值:高,有明确硬件环境和量化指标
  • 涉及版本:vLLM / SGLang / TensorRT-LLM / TGI / lmdeploy
  • 建议分类:推理框架 vLLM SGLang TensorRT-LLM 性能优化
  • 后续行动:检索完整 URL,确认真实发布链接

条目 4|别让你的RAG停留在两年前:万字拆解2026大模型检索技术真实落地现状

  • 链接:https://blog.csdn.net/逐梦苍穹/article/details/(待确认)
  • 作者:逐梦苍穹
  • 发布时间:2026-02-22
  • 数据指标:2120 阅读
  • 核心内容:
  • 纯向量检索被混合架构全面取代
  • LazyGraph RAG 成本优化
  • Agentic RAG 高达 90% 生产失败率技术陷阱
  • RAG 框架选型与工程落地指南
  • 工程价值:⭐⭐⭐⭐ | 有排障经验和真实生产痛点,非科普文
  • 复现价值:高,提供了失败案例分析
  • 建议分类:RAG Agentic RAG GraphRAG 工程排障
  • 后续行动:核验完整 URL;补充 Agentic RAG 失败率数据来源

二、CSDN 需过滤条目(低工程价值)

条目 过滤原因
"爆火!2026 RAG实战保姆级指南"(lyy_kao) 标题党,无版本/命令/代码,仅 599 阅读,无复现过程
"2026版RAG技术全解析"(youmaob) 内容泛泛,无实战代码,无排障经验
"2026 年 RAG 技术最新进展"(2501_92406411) 资讯汇总,无源码,无版本,无工程细节
"2026年七大主流 AI Agent框架深度对比"(xx_nm98) 框架列表罗列,缺少实测数据和代码

三、Substack 高价值线索

AIxFunda(Kalyan KS)— 每周 LLM/RAG/Agent Updates

  • 订阅地址:https://aixfunda.substack.com/
  • 可信度:较高(信息密集,每周更新,有引用链接)
  • 近期要点摘录(2026年3-4月):
  • Hugging Face Synthetic Data Playbook(90+实验,训练数据清洗配方)
  • Google Gemini Embedding 2(统一多模态向量空间,文本/图片/视频/音频/PDF)
  • Claude Opus 4.6 / Sonnet 4.6 支持 100 万 Token 上下文
  • Mistral Small 4(Apache 2.0,统一推理+多模态+编码)
  • Ai2 MolmoWeb(开源 Web Agent,4B/8B 参数,基于截图完成浏览器任务)
  • llama.cpp 突破 100k GitHub Stars
  • Z.ai GLM-5V-Turbo(Design2Code 94.8%,视觉编码专项)
  • 建议:作为每周行业追踪来源,不做全文复制,仅记录关键节点

四、分类标签(知识库)

RAG Agent LLM 推理框架 vLLM SGLang LangGraph GraphRAG Agentic RAG 多模态 平台选型 性能评测


五、建议写入路径

/shared/research-kb/inbox/jay/2026-10-07-csdn-rag-llm-agent-highvalue.md


六、后续行动

  1. [ ] 核验推理框架横评完整 URL(tpriwwq)
  2. [ ] 核验逐梦苍穹 RAG 文章完整 URL
  3. [ ] 精读 Agent 架构范式(vitaviva)全文,评估 LangGraph 代码可用性
  4. [ ] 将 AIxFunda 关键节点同步至知识库追踪页
  5. [ ] 评估是否需要主题页更新(建议建立 RAG 工程实践 专题页)