addyosmani/agentskills 是 Google Chrome 工程总监 Addy Osmani 主导维护的生产级 AI 编码 Agent 工程技能包。它将资深工程师在软件开发全生命周期中的工作流程、质量门禁和最佳实践封装为可被 AI Agent 理解并一致执行的 Markdown 技能文件(.md)。 该仓库提供 24 个结构化技能,覆盖从"…
仓库攻略
152 篇 · 152 个项目 · Agent 智能体 · 工程化
anthropics/skills 是 Anthropic 官方维护的 Agent Skills 示例与规范仓库。所谓 "Skill"(在 Anthropic 体系里),是一个带 YAML frontmatter 的 Markdown 指令包:一个文件夹 + 一份 SKILL.md + 一组可选脚本/资源,Claude 在识别到任务匹配时会动态加载并执行它。…
Agency Agents 是一个面向 AI 编码工具的专家 Agent 人格库,以 Markdown 文件形式提供,每个 Agent 都有独立人格、专长域、可交付成果和工作流程。目前支持 Claude Code、Cursor、Codex、OpenCode、Gemini CLI、OpenClaw 等主流 Coding Agent,另有工程、安全、嵌入式、合规…
mattpocock/skills 是 Matt Pocock(TypeScript 教学者、 前 Vercel 工程师)将自己的 .agents 目录公开的仓库,收录他在日常真实工程中使用的 Agent 技能。这些技能面向真实软件开发,而非 vibe coding,核心理念是:小型、易适配、可组合;基于数十年工程经验,适用于任何模型。 仓库规模极大(Sta…
本攻略核验了 Jerry Liu 原帖中每项工程主张的来源与背景。Loop Engineering 作为 2026 年 AI 工程领域的核心实践,已有多篇高质量一手博客覆盖,以下内容以这些来源为主、原文为辅,冲突处以官方文档为准。 Loop Engineering(循环工程) 是 2026 年 AI Agent 工程领域崛起的一种新实践范式:与其让人一步步 …
QM 是一个多人 AI 编程智能体平台,设计目标是让一个 AI 编程智能体服务于整个公司,而非仅限于个人助手。与传统单人 Copilot 不同,QM 通过「scope(作用域)」机制实现多用户隔离与协作: 核心:TypeScript / Node.js,HTTP 层用 Fastify Slack 插件:Scaffolded with Bolt Web UI:…
LongHorizonTerminalBench(LHTB)是一个评测 Agent 在长时序终端任务上持续工作能力的基准测试,2026 年 7 月由来自腾讯(Tencent HY LLM Frontier)、Lehigh University、University of Maryland、University of Georgia、University of…
PocketFlow 是一个仅用 100 行 Python 代码实现的轻量级 LLM 框架,核心思想是将 LLM 应用建模为有向图(Graph)。框架本身零依赖(仅需 asyncio),安装包仅 56KB,却能表达 Agent、Workflow、RAG、MultiAgent 等常见设计模式。 作者的核心论点是:市面上的主流 LLM 框架(LangChain、…
envd(ɪnˈvdɪ,读作 "invideo")是 TensorChord 开源的一个面向 AI/ML 的容器化开发环境构建工具。它用一个声明式的 build.envd 文件描述你的训练/推理环境,然后用一个 envd up 命令把它打包成 OCI 兼容的镜像,并在本地(或远端 K8s 集群)跑起来。 它不是 Dockerfile 的替代品那种简单封装——…
DataFlowHarness 是北京大学联合中关村 Academy 于 2026 年 7 月 18 日发布的一个代码 Agent 平台(技术报告 arXiv:2607.16617),核心解决一个实际问题:LLM 代码 Agent 生成的往往是「一次性脚本」而非可持续编辑的生产级数据流水线——作者将此称为 NL2Pipeline Gap(自然语言到流水线之间…
NemoClaw for LangChain Deep Agents Blueprint(简称 NemoClaw)是 LangChain 与 NVIDIA 联合发布的企业级 Agent 参考架构,发布时间为 2026 年 7 月 8 日(PRNewswire)。 该 Blueprint 不是一款独立产品,而是把三层开源组件打包成一套可落地、可自托管的完整 A…
NitroStack 是一个用 TypeScript 构建的生产级 MCP(Model Context Protocol)服务器全栈框架。它包含核心 SDK(@nitrostack/core)、脚手架 CLI(@nitrostack/cli)、React UI 组件库(@nitrostack/widgets)以及配套桌面 IDE(NitroStudio),覆…
LlamaParse Retrieval Harness 是 LlamaIndex(LlamaParse 平台)在 2026 年 6 月 29 日正式上线的一套面向 Agent 的文档遍历工具集,被定位为"2026 版 RAG"。它不再将文档检索视为一次性的语义搜索,而是把整个文档语料库暴露为一组类文件系统工具,让 Agent 能在单次推理循环内自由交替调用…
ghidramcp 是一个生产级 MCP(Model Context Protocol)服务器,将 NSA 开源的 Ghidra 反编译引擎以 269 个 MCP 工具的形式暴露给 AI Agent,供其进行 AI 驱动的二进制逆向工程。与大多数 Ghidra MCP 实现只提供几个只读工具不同,这是一个由真实逆向工程师日常使用的完整方案——支持完整的写操作…
Claude Scholar 是一个半自动化 AI 学术研究助手,面向计算机科学和 AI 研究者设计,核心功能覆盖文献调研、代码实验、报告撰写、论文写作和项目知识管理。它并非一个独立的 AI 模型或应用,而是一套 Claude Code / Codex / Kimi Code CLI / OpenCode 的技能(Skills)和工作流配置层,通过向这些编码…
Retrieval Harness 是 LlamaIndex 在 2026 年提出的一种面向 Agent 的持久化检索架构模式,其参考实现为 runllama/legalkb(法律文档知识库 Demo)。 区别于传统的单次向量搜索 RAG,Harness 将文档知识库包装成一组类文件系统 API 工具(retrieve / findFiles / readF…
Apache Burr(incubating)是一个 Python 状态机框架,用来构建"会做决策的应用"——chatbot、agent、simulation、人机协作工具。它把应用建模成一张 state machine(状态机/流程图): Burr 的关键设计哲学是 "框架无关":它不规定你必须用哪个 LLM SDK、哪个 vector DB、哪个 age…
OpenLIT 是一个开源的 AI Engineering 平台,定位是"一站式把 LLM 应用从实验推到生产"。它把 OpenTelemetry 当作统一底座,向上提供 6 类核心能力: 1. 可观测性 SDK(Python / TypeScript / Go):对 50+ LLM provider、VectorDB、Agent 框架、GPU 做自动埋点(…
2026 年 7 月 14 日上传至 arXiv 的一篇97 页大survey(arXiv:2607.13104),由 DAIR.AI 团队(Zhe Ren、Yimeng Chen 等)联合 Jürgen Schmidhuber 等人撰写。配套 GitHub 仓库 selfimprovingagent/awesomeSelfImprovingAgents 提…
这是 Decoding AI 杂志社出品的开源实战课程仓库,教你从零搭建一个"Second Brain AI 助手" —— 让你的 Notion / 网页笔记 / 文档作为个人知识库,配合 agent + RAG + 微调 + LLMOps,做出一个能聊你自己的笔记的生产级 AI 助手。MIT 协议、纯 Jupyter Notebook + Python、最…
Sakana AI 在 ICLR 2026 发表了一篇非常有意思的论文:让一个小模型学会当「指挥家」,而不是自己下场干活。 传统多智能体系统的做法是:人类预先写好流水线(planner → coder → verifier),然后让模型按这个固定流程走。问题在于:不同任务复杂度差异巨大——简单事实问答根本不需要 5 步 pipeline,而复杂编程题可能需要…
ZenML 是一个面向 ML/AI 工程师的统一 AI 平台,核心价值主张是:一次编写,随处运行——用 Python 装饰器定义管道(pipelines)和步骤(steps),ZenML 自动处理容器化、追踪、部署和基础设施抽象,让你无需改动代码即可在本地、Kubernetes、云端之间切换。 ZenML 的定位介于实验追踪工具(MLflow、W&B)和完整…
Agent Starter Pack(ASP) 是 Google Cloud 官方出的 生产级 GenAI Agent 模板项目:用 Python 包形式提供一整套「Agent + 后端 + 前端 + 部署基础设施 + 监控 + CI/CD」的项目骨架,让开发者只关心 agent 业务逻辑。 它支持多种 agent 框架 / 模式(自带模板): 重要变更:R…
DocsGPT 是一个开源的私有 AI 知识库与 Agent 构建平台,专注于让团队在完全私有化的环境下,对文档、代码库、内部知识进行 AI 问答与智能搜索。它融合了 RAG(检索增强生成)、多模型支持、Deep Research 模式和低代码 Agent 可视化构建器,适合企业和开发者私有部署。 核心定位:把 LangChain + RAG + Agent…
mcpagent 是 Lastmile AI 开源的、专门面向 Model Context Protocol(MCP) 的 Python Agent 框架。它的基本立场是:"MCP 就够了,简单的可组合模式比花哨架构更稳"。它围绕一个 MCPApp 运行时来注册 Agent、MCP 服务器、工具和工作流,把 Anthropic 那篇「Building Eff…
Coze Loop 是字节跳动 Coze(扣子)平台推出的AI Agent 全生命周期运营平台,最近将核心模块开源(Apache 2.0)。它解决的是 AI Agent 开发过程中"写 Prompt → 调试 → 评估效果 → 上线监控"这一整条链路的工程化问题。 开源版提供三大核心能力:Prompt 开发和调试(Playground)、自动化评估(Eval…
mcpuse 是一个全栈 MCP(Model Context Protocol)开发框架,帮助开发者快速构建 MCP Servers(工具服务器)和 MCP Apps(可交互的 AI 应用组件),同时提供 MCP Client / MCP Agent 客户端实现,内置 Web 版 Inspector 调试工具,并支持一键部署到 Manufact MCP Cl…
Giskard 是一个开源 Python 库,专为测试和评估 AI Agent 系统而设计,由法国团队 GiskardAI 维护。它经历了从 v2 到 v3 的重大重写:v3 采用模块化架构,将功能拆分为 giskardchecks(轻量测试)、giskardscan(红队漏洞扫描)和规划中的 giskardrag(RAG 评估)三个独立包,去掉了 v2 中…
XcodeBuildMCP 是 Sentry 团队开源的 Model Context Protocol(MCP)服务器 + CLI 工具,专为 AI 编码 agent(Cursor、Claude Code、Codex 等)设计,提供操作 iOS/macOS 项目的工具集——构建、运行、测试、安装应用到模拟器/设备等,全部通过结构化工具接口暴露给 AI。 它有…
holaOS 是 Holaboss 团队开源的一个「本地优先(localfirst)AI 工作桌面」运行时与桌面 App(基于 Electron + TypeScript,底层 Node 24.14.1),主打"超级工作 Agent(super agent for work)"——把 Gmail、Slack、Notion、GitHub、Jira、Linear…