知识库草稿:RAG / LLM / Agent CSDN 高价值内容 + Substack 线索
产出时间:2026-10-07 12:20 (Asia/Shanghai)
实例:Jay
主题
RAG 系统工程实践 · LLM Agent 架构选型 · 推理框架横评(CSDN 高价值检索)
一、CSDN 高价值条目(工程/复现价值)
条目 1|Agent 开发的五种架构范式及选型思路
- 链接:https://blog.csdn.net/vitaviva/article/details/161141374
- 作者:vitaviva
- 发布时间:2026-05-18
- 数据指标:926 阅读 / 19 点赞 / 21 评论
- 核心内容:
- ReAct 框架原理(思考-行动循环)
- LangGraph 实现方案:工具定义、LLM 绑定、Agent 节点构建
- 五种架构范式对比与选型场景分析
- 工程价值:⭐⭐⭐⭐ | 提供了 LangGraph 实际代码结构,非纯概念
- 复现价值:有代码示例,可直接复用
- 涉及版本:LangGraph(需进一步核验具体版本)
- 建议分类:
Agent架构范式LangGraphReAct - 后续行动:建议对比原版 LangGraph 官方文档,核验 API 是否有 Breaking Change
条目 2|2026年LLM Agent平台选型:五大方案横评与开发实践
- 链接:https://blog.csdn.net/m0_69581581/article/details/166139719
- 作者:m0_69581581
- 发布时间:2026-09-20
- 数据指标:64 阅读(较低)/ 1 点赞 / 2 评论
- 核心内容:
- 横评平台:SiliconFlow、Hugging Face、Fireworks AI、Uniphore、Seldon
- Agent 开发核心矛盾:模型能力与工程复杂度错位
- 各平台软件能力边界分析
- 工程价值:⭐⭐⭐⭐ | 平台横评信息密集,有实测数据
- 复现价值:需获取原文全文确认是否有可运行代码示例
- 建议分类:
Agent平台选型LLM2026 - 后续行动:阅读原文确认代码量和深度
条目 3|推理框架横评:vLLM / TGI / TensorRT-LLM / SGLang
- 链接:https://blog.csdn.net/tpriwwq/article/details/(从搜索片段推断)
- 作者:tpriwwq
- 发布时间:2026-07-07
- 数据指标:538 阅读
- 核心内容:
- vLLM:通用场景稳健
- SGLang:RadixAttention 在 Agent/JSON 场景领先
- TensorRT-LLM:性能最优但工程复杂
- TGI:与 HF 生态深度集成
- lmdeploy:专注国产化需求
- 工程价值:⭐⭐⭐⭐⭐ | 生产级性能测试,有延迟/吞吐/显存对比
- 复现价值:高,有明确硬件环境和量化指标
- 涉及版本:vLLM / SGLang / TensorRT-LLM / TGI / lmdeploy
- 建议分类:
推理框架vLLMSGLangTensorRT-LLM性能优化 - 后续行动:检索完整 URL,确认真实发布链接
条目 4|别让你的RAG停留在两年前:万字拆解2026大模型检索技术真实落地现状
- 链接:https://blog.csdn.net/逐梦苍穹/article/details/(待确认)
- 作者:逐梦苍穹
- 发布时间:2026-02-22
- 数据指标:2120 阅读
- 核心内容:
- 纯向量检索被混合架构全面取代
- LazyGraph RAG 成本优化
- Agentic RAG 高达 90% 生产失败率技术陷阱
- RAG 框架选型与工程落地指南
- 工程价值:⭐⭐⭐⭐ | 有排障经验和真实生产痛点,非科普文
- 复现价值:高,提供了失败案例分析
- 建议分类:
RAGAgentic RAGGraphRAG工程排障 - 后续行动:核验完整 URL;补充 Agentic RAG 失败率数据来源
二、CSDN 需过滤条目(低工程价值)
| 条目 | 过滤原因 |
|---|---|
| "爆火!2026 RAG实战保姆级指南"(lyy_kao) | 标题党,无版本/命令/代码,仅 599 阅读,无复现过程 |
| "2026版RAG技术全解析"(youmaob) | 内容泛泛,无实战代码,无排障经验 |
| "2026 年 RAG 技术最新进展"(2501_92406411) | 资讯汇总,无源码,无版本,无工程细节 |
| "2026年七大主流 AI Agent框架深度对比"(xx_nm98) | 框架列表罗列,缺少实测数据和代码 |
三、Substack 高价值线索
AIxFunda(Kalyan KS)— 每周 LLM/RAG/Agent Updates
- 订阅地址:https://aixfunda.substack.com/
- 可信度:较高(信息密集,每周更新,有引用链接)
- 近期要点摘录(2026年3-4月):
- Hugging Face Synthetic Data Playbook(90+实验,训练数据清洗配方)
- Google Gemini Embedding 2(统一多模态向量空间,文本/图片/视频/音频/PDF)
- Claude Opus 4.6 / Sonnet 4.6 支持 100 万 Token 上下文
- Mistral Small 4(Apache 2.0,统一推理+多模态+编码)
- Ai2 MolmoWeb(开源 Web Agent,4B/8B 参数,基于截图完成浏览器任务)
- llama.cpp 突破 100k GitHub Stars
- Z.ai GLM-5V-Turbo(Design2Code 94.8%,视觉编码专项)
- 建议:作为每周行业追踪来源,不做全文复制,仅记录关键节点
四、分类标签(知识库)
RAG Agent LLM 推理框架 vLLM SGLang LangGraph GraphRAG Agentic RAG 多模态 平台选型 性能评测
五、建议写入路径
/shared/research-kb/inbox/jay/2026-10-07-csdn-rag-llm-agent-highvalue.md
六、后续行动
- [ ] 核验推理框架横评完整 URL(tpriwwq)
- [ ] 核验逐梦苍穹 RAG 文章完整 URL
- [ ] 精读 Agent 架构范式(vitaviva)全文,评估 LangGraph 代码可用性
- [ ] 将 AIxFunda 关键节点同步至知识库追踪页
- [ ] 评估是否需要主题页更新(建议建立
RAG 工程实践专题页)