CSDN 高价值技术分享 · LLM/RAG/Agent 领域精选
采集时间: 2026-07-26
检索范围: CSDN 全站 · LLM · RAG · Agent · vLLM · 深度学习框架
采集工具: Tavily Search
🏆 高价值条目(源码分析/工程实践/排障经验)
1. vLLM 源码解析系列(weixin_42479327)
| 属性 |
内容 |
| 标题 |
vllm源码解析(一):整体架构与推理代码 |
| 链接 |
https://blog.csdn.net/weixin_42479327/article/details/141496484 |
| 价值类型 |
源码分析 + 架构解读 |
| 工程价值 |
⭐⭐⭐⭐⭐ |
| 版本/日期 |
2024-08-18,代码基于 v0.4.1 |
| 核心内容 |
vLLM 整体架构、PagedAttention 原理、Continuous Batching、推理代码流程、数据结构解析 |
| 复现价值 |
高——提供完整代码片段和调用示例 |
| 可信度 |
高——CC 4.0 BY-SA 协议,代码解读详细 |
| 建议分类 |
LLM推理 vLLM PagedAttention 源码分析 |
| 属性 |
内容 |
| 标题 |
vllm源码解析(二):调度策略分析 |
| 链接 |
https://blog.csdn.net/weixin_42479327/article/details/141614205 |
| 价值类型 |
源码分析 + 调度逻辑 |
| 工程价值 |
⭐⭐⭐⭐⭐ |
| 版本/日期 |
2024 年,v0.4.x |
| 核心内容 |
vLLM 调度器数据结构、running/swapped/waiting 队列管理、调度策略原理解析 |
| 复现价值 |
高——调度逻辑是 vLLM 性能优化核心 |
| 可信度 |
高 |
| 建议分类 |
LLM推理 vLLM 调度策略 源码分析 |
| 属性 |
内容 |
| 标题 |
vllm源码解析(四):LLM模型权重加载与kv-cache初始化 |
| 链接 |
https://blog.csdn.net/weixin_42479327/article/details/141718951 |
| 价值类型 |
源码分析 + 模型加载 |
| 工程价值 |
⭐⭐⭐⭐ |
| 版本/日期 |
2024 年 |
| 核心内容 |
模型权重加载流程、KV Cache 初始化机制、vLLM 内存管理 |
| 建议分类 |
LLM推理 vLLM 模型加载 KVCache |
2. RAG 知识库商用问题与改进方案(v_JULY_v)
| 属性 |
内容 |
| 标题 |
RAG知识库问答LangChain+LLM的二次开发:商用时的典型问题及其改进方案 |
| 链接 |
https://blog.csdn.net/v_JULY_v/article/details/135257848 |
| 价值类型 |
排障经验 + 工程实践 |
| 工程价值 |
⭐⭐⭐⭐⭐ |
| 版本/日期 |
2024-03-15(持续更新) |
| 核心内容 |
1. Embedding 模型选择(Bert→BGE替换方案) 2. 结构化/非结构化文档分割方法 3. PDF 解析(PyPDF2/pdfplumber/fitz 对比) 4. 表格问答策略(OCR→Excel→HTML) 5. Reranker 微调方案 |
| 复现价值 |
极高——企业级 RAG 落地必读,实战排障经验 |
| 可信度 |
高——1.8万阅读,工程验证充分 |
| 建议分类 |
RAG LangChain 知识库 商用落地 排障 |
3. RAGFlow 开源项目深度解析
| 属性 |
内容 |
| 标题 |
开源RAG神器RAGFlow深度解析:融合Agent能力,零门槛搭建企业级AI知识库 |
| 链接 |
https://adg.csdn.net/69533a285b9f5f31781bedfb.html |
| 价值类型 |
工具评测 + 部署指南 |
| 工程价值 |
⭐⭐⭐⭐ |
| 核心内容 |
RAGFlow 核心特性:无限token检索、模板化分块、可追溯引用、自动化RAG工作流;Docker 部署步骤;2025年更新亮点 |
| 复现价值 |
高——提供 3 步启动指南 |
| 建议分类 |
RAG RAGFlow 知识库 部署 |
4. LlamaIndex 企业级 RAG 实战
| 属性 |
内容 |
| 标题 |
LlamaIndex数据连接原理与企业级RAG实战指南 |
| 链接 |
https://blog.csdn.net/weixin_30540871/article/details/162186322 |
| 价值类型 |
原理分析 + 实战 |
| 工程价值 |
⭐⭐⭐⭐ |
| 核心内容 |
LlamaIndex 数据连接器原理、与 LangChain 对比(3行 vs 10+行胶水代码)、内置重排序/元数据过滤 |
| 建议分类 |
RAG LlamaIndex 企业级 |
5. AI工程化内存诊断实战手册
| 属性 |
内容 |
| 标题 |
AI工程化内存诊断实战手册(2024最新版) |
| 链接 |
https://blog.csdn.net/GatherLume/article/details/163103957 |
| 价值类型 |
排障经验 + 性能优化 |
| 工程价值 |
⭐⭐⭐⭐⭐ |
| 核心内容 |
TensorFlow/PyTorch 内存泄漏诊断、Dataset 操作追踪、ResourceTensor 清理、复现步骤对比表 |
| 复现价值 |
高——提供具体复现命令和对比数据 |
| 建议分类 |
PyTorch TensorFlow 内存优化 排障 工程化 |
6. PyTorch复现顶会论文致命陷阱
| 属性 |
内容 |
| 标题 |
PyTorch复现顶会论文的5个致命陷阱:我的TensorFlow转PyTorch踩坑全记录 |
| 链接 |
https://blog.csdn.net/q6r7s8t9/article/details/154930242 |
| 价值类型 |
排障经验 + 复现指南 |
| 工程价值 |
⭐⭐⭐⭐ |
| 核心内容 |
1. 网络结构实现差异导致训练行为不同 2. 环境配置对齐 3. 数据预处理差异 4. 指标对齐方法 |
| 复现价值 |
极高——顶会论文复现必读 |
| 建议分类 |
PyTorch 论文复现 排障 深度学习 |
7. Anaconda + CUDA 配置避坑指南
| 属性 |
内容 |
| 标题 |
2024 Anaconda安装避坑指南:系统兼容、镜像配置与CUDA |
| 链接 |
https://blog.csdn.net/weixin_28595749/article/details/162649423 |
| 价值类型 |
环境配置 + 排障 |
| 工程价值 |
⭐⭐⭐⭐ |
| 核心内容 |
PyTorch 2.2 要求 CUDA 12.1,TensorFlow 2.16 只认 CUDA 11.8 的共存方案;conda 环境配置技巧 |
| 复现价值 |
高——深度学习环境配置必备 |
| 建议分类 |
环境配置 Anaconda CUDA PyTorch TensorFlow |
8. Windows 11 + RTX 40系显卡 深度学习环境
| 属性 |
内容 |
| 标题 |
Windows 11 + RTX 40系显卡:从零配置TensorFlow 2.15与PyTorch 2.2深度学习环境(2024最新版) |
| 链接 |
https://blog.csdn.net/weixin_42552637/article/details/160366301 |
| 价值类型 |
环境配置 + 复现指南 |
| 工程价值 |
⭐⭐⭐⭐ |
| 核心内容 |
Windows 11 下的 TF 2.15 + PyTorch 2.2 双框架配置;RTX 40系显卡兼容问题 |
| 建议分类 |
环境配置 Windows RTX40 PyTorch TensorFlow |
9. LLM推理引擎对比(2025选型指南)
| 属性 |
内容 |
| 标题 |
大模型推理成本每年降低10倍的秘密:一文了解vLLM、SGLang等6款主流推理引擎 |
| 链接 |
https://blog.csdn.net/bumblexbee/article/details/147740563 |
| 价值类型 |
技术对比 + 选型指南 |
| 工程价值 |
⭐⭐⭐⭐ |
| 核心内容 |
vLLM vs SGLang vs TGI vs TensorRT-LLM 深度对比;RadixAttention vs PagedAttention;DeepSeek 与开源社区贡献策略 |
| 建议分类 |
LLM推理 推理引擎 vLLM SGLang 选型 |
10. 大模型推理框架社区对比
| 属性 |
内容 |
| 标题 |
最受欢迎的开源大模型推理框架 vLLM、SGLang 是如何炼成的? |
| 链接 |
https://blog.csdn.net/dqcfkyqdxym3f8rb0/article/details/152054356 |
| 价值类型 |
技术史 + 社区分析 |
| 工程价值 |
⭐⭐⭐⭐ |
| 核心内容 |
vLLM(SGS 2023.6)和 SGLang(2024.1)发展史、UC Berkeley 师承关系(Ion Stoica→Spark/Ray)、a16z 资助、GitHub 数据对比 |
| 建议分类 |
LLM推理 vLLM SGLang 开源史 |
📋 分类标签汇总
| 标签 |
数量 |
代表文章 |
LLM推理 |
6 |
vLLM系列、推理引擎对比 |
RAG |
4 |
RAGFlow、LlamaIndex、RAG商用问题 |
vLLM |
4 |
源码解析系列、推理引擎对比 |
PyTorch |
3 |
内存诊断、论文复现、环境配置 |
源码分析 |
3 |
vLLM系列 |
排障 |
3 |
内存诊断、论文复现、环境配置 |
环境配置 |
3 |
Anaconda、RTX40、Windows双框架 |
LangChain |
2 |
RAG商用问题、企业级RAG |
知识库 |
2 |
RAGFlow、企业级RAG |
SGLang |
2 |
推理引擎对比、开源史 |
🎯 建议写入路径
主草稿: /shared/research-kb/inbox/jay/2026-07-26-csdn-llm-rag-agent.md
关联草稿建议:
- /shared/research-kb/inbox/jay/2026-07-26-csdn-hf-finetuning.md(HuggingFace 微调专题)
- /shared/research-kb/inbox/jay/2026-07-26-csdn-dl-framework-env.md(深度学习框架环境专题)
🔬 后续行动建议
| 优先级 |
行动 |
理由 |
| 🔴 高 |
精读 vLLM 源码解析系列 (weixin_42479327) |
源码分析质量高,工程价值极高 |
| 🔴 高 |
精读 RAG 商用问题排障 (v_JULY_v) |
企业 RAG 落地实战经验,难得 |
| 🟡 中 |
关注 LlamaIndex vs LangChain 对比文章 |
框架选型参考 |
| 🟡 中 |
审阅 推理引擎对比 2025 选型文章 |
帮助快速决策 |
| 🟢 低 |
整理 深度学习环境配置专题 |
通用基础资源 |
⚠️ 未写入说明
本次 未发现 需要写入 /shared/research-kb/review/ 或执行 Git 写入的内容。所有内容均为 CSDN 技术分享摘要,符合知识库草稿规范,可供后续专题页更新使用。
产出状态: 草稿完成
下一步: 如需合并到知识库主分支,请触发单独同步任务(串行处理)