AI 工程・GitHub Trending + HF 精选(2026-08-20)
实例: Jay | 检索范围: GitHub Trending · Hugging Face · arXiv · Substack · 官方博客
标签: LLM Agent RAG Multimodal MLOps Security Open-Source
🔬 高价值论文 / 框架
1. FROAV — RAG 可观测与 Agent 验证框架
- 来源: arXiv:2601.07504(2026-01-13,Aethech)
- 链接: https://arxiv.org/abs/2601.07504
- 可信度: ⭐⭐⭐ 高(学术论文,有 n8n/PostgreSQL/FastAPI/Streamlit 完整集成)
- 摘要: 提出 LLM-as-a-Judge 评估范式,结合 RAG 多阶段 pipeline,支持可视化工作流编排。专为降低 LLM Agent 研究门槛设计,适合快速原型验证 RAG 策略和 Prompt 工程迭代。
- 核心技术栈: n8n(无代码工作流)+ PostgreSQL(细粒度数据管理)+ FastAPI + Streamlit
- 评价: 工程化程度高,有 GUI,生产级参考价值强。
- 行动建议: 精读源码架构,考虑纳入 RAG 工程最佳实践参考。
2. Agentic RAG 系统演进研究(AI-VaxGuide)
- 来源: arXiv:2507.03493
- 可信度: ⭐⭐⭐ 中高(Gemini Flash 2.0 实验对照,有 benchmark)
- 核心结论: AgenticRAG > EnhancedRAG > SimpleRAG > 微调模型,在复杂查询场景优势明显,但计算开销增加。适合约束领域(有限训练数据)。
- 行动建议: RAG 架构选型参考。
3. MOYA Framework — 多 Agent CloudOps
- 来源: arXiv:2501.08243
- 可信度: ⭐⭐ 中(CloudOps 领域专项研究)
- 摘要: 整合 multi-agent + RAG 实现复杂云运维自动化,强调实时处理与可靠性。monolithic RAG → modular agentic 演进路径值得参考。
- 行动建议: 略读,关注架构分层思路。
🤖 HF Trending 高价值条目
4. LongHorizon(阿里巴巴)⭐170 HF Upvotes
- 来源: Hugging Face Papers(2026-08-03)
- 链接: https://huggingface.co/papers/trending
- 核心: manage-execute-audit loop,显式跟踪验证任务状态,适合长周期 Agent 场景。
- 评价: 生产级 Agent 记忆/状态管理方案,可与 ReAct/MemGPT 对比参考。
- 行动建议: 关注工程实现。
5. LFM2.5-VL-3B(Liquid AI)多模态边缘模型
- 来源: Hugging Face Blog(2026-08-12)
- 链接: https://huggingface.co/blog/LiquidAI/lfm2-5-vl-3b
- 可信度: ⭐⭐⭐ 高(商业公司官方博客,有 benchmark)
- 摘要: 3B 参数非推理视觉语言模型,支持屏幕理解、目标定位(bounding box)、函数调用、多图输入。SigLIP2 NaFlex 视觉编码器。专为 on-device 场景优化,延迟低。
- 配套模型: LFM2.5-VL-450M(ONNX 导出版),适合更受限设备。
- 行动建议: 边缘部署/多模态 RAG 项目可评估集成。
6. LFM2.5-2.6B — 本地 Agent 部署指南
- 来源: Hugging Face Blog(2026-08-04),作者含 Maxime Labonne
- 链接: https://huggingface.co/blog/LiquidAI/lfm2-5-2-6b
- 摘要: 详细本地 Agent 部署指南,覆盖 WebGPU demo、Docker Model Runner、端侧推理优化。
- 评价: 工程实操性强,适合本地 LLM 部署参考。
7. State of Open Models: Summer 2026(HF 官方)
- 来源: Hugging Face Blog
- 链接: https://huggingface.co/blog/state-of-open-models-summer-2026
- 关键洞察:
- 模型仓库 2.43M → 2.96M,数据集 711K → 1M,Spaces 1.00M → 1.44M
- 85.6% 模型 <200 下载,1.5% 仓库占 99.2% 下载量(极端长尾)
- 前沿:Thinking Machines Inkling (952B)、NVIDIA Nemotron 3 Ultra (561B)
- 中国模型主导开源前沿权重(DeepSeek V4 等)
- 行动建议: 宏观了解开源模型生态格局,适合年度回顾引用。
🔐 安全 / OWASP
8. OWASP Top 10 Agents & AI 漏洞(2026)
- 来源: Alex Weron(open.substack.com,2026)
- 链接: https://open.substack.com/pub/alexewerlof/p/owasp-top-10-ai-llm-agents
- 可信度: ⭐⭐⭐ 高(OWASP 标准)
- 高优先级漏洞:
- LLM07 系统 Prompt 泄露: 缓解:密钥不出现在 Prompt,使用安全保险库
- LLM08 向量/Embedding 弱点: 共享向量 DB 仅靠应用层过滤,可被 embedding payload 跨租户攻击。缓解:加密命名空间隔离
- LLM04 数据投毒: RAG 知识库上传恶意 PDF,LLM 将其当作ground truth
- 行动建议: 所有 RAG/Agent 项目安全评审必读。
🌐 Substack 高价值文章
9. 1000+ 职位描述揭示 AI 工程师技能需求
- 来源: alexeyondata.substack.com
- 链接: https://alexeyondata.substack.com/p/what-1000-job-descriptions-reveal
- 可信度: ⭐⭐⭐ 高(1000+ 样本量统计)
- 核心洞察:
- 70% 为 AI-first 职位(直接做 RAG/Agent/评估/部署)
- 28.5% 为 AI-support 职位(基础设施/平台/GPU 运维)
- 核心技能:LLM 集成、RAG、Agent 工作流、API 部署、监控、评估
- 趋势:职位要求从"学框架"转向"理解系统架构"
- 行动建议: 课程/技能树设计参考。
10. 2026 AI Agent 学习路径
- 来源: aiagentssimplified.substack.com
- 链接: https://aiagentssimplified.substack.com/p/the-2026-path-to-learning-ai-agents
- 核心观点:
- 系统设计:编排 LLMs、工具、数据库、子 Agent 如同后端架构
- 工具设计:严格 Schema 定义 I/O,防止 LLM 错误
- 检索工程:chunking、embeddings、re-ranking
- 可靠性:重试、超时、退避、熔断
- 评价: 实操性强,适合作为学习路线验证。
11. 为什么 2026 年从 RAG 开始学 AI 工程
- 来源: jamwithai.substack.com
- 链接: https://jamwithai.substack.com/p/how-to-start-with-ai-engineering
- 核心观点: RAG 覆盖 AI 工程全栈:ETL pipeline、OCR/PDF、embedding indexing、hybrid search、FastAPI、Docker、缓存、可观测性。比直接学 LangChain 或 Agents 更系统。
- 行动建议: 初学者路线参考。
📊 GitHub Top Projects 追踪(2026-08-19 更新)
| 项目 | 语言 | Stars | 摘要 |
|---|---|---|---|
| langchain-ai/langchain | Python | 143K+ | 经典 Agent 工程平台,RAG/Tools/编排 |
| dify | TypeScript | 152K+ | 领先开源 LLM app 平台,Agentic workflow + RAG pipeline |
| open-webui | Python | 149K+ | 本地 AI 界面,Ollama事实标准网关 |
| ragflow | Go | 87K+ | RAG 引擎 + Agent,深度文档理解 |
| Graphify-Labs/graphify | Python | 104K+ | 代码/文档→知识图谱,AST 解析无需向量库 |
| awesome-llm-apps | Python | 133K+ | 100+ AI Agent / RAG 应用示例 |
| hermes-agent | Python | 229K+ | 可成长 Agent 框架(数据存疑,核实中) |
| cc-switch | Rust | 128K+ | 跨平台 All-in-One AI 助手(支持 OpenClaw) |
🏷️ 分类标签汇总
LLM Agent RAG Multimodal Edge-AI Vector-DB Security OWASP Evaluation Observability Local-Deployment MLOps CloudOps FastAPI n8n Open-Source-Ecosystem
📋 建议写入路径
- 主文件:
/shared/research-kb/inbox/jay/2026-08-20-ai-engineering-trending.md - 关联草稿可考虑:
2026-08-20-FROAV-framework.md— FROAV 深度笔记2026-08-20-LFM25-VL-analysis.md— 边缘多模态模型分析2026-08-20-OWASP-AI-security.md— AI 安全专项2026-08-20-Github-AI-ecosystem.md— GitHub Top 项目追踪
✅ 本次行动
- 精读建议: FROAV(工程架构参考)、OWASP Top 10 AI(安全必读)、LongHorizon(Agent 状态管理)
- 审稿建议: LFM2.5-VL 技术博客(多模态 RAG 集成评估)
- 主题页更新建议: 新增"边缘 AI / 多模态 RAG"分类;更新"AI 工程技能图谱"(参考 Substack 职位分析)