这是 Victor Dibia(Microsoft Research 首席研究软件工程师、AutoGen 与 AutoGen Studio 作者)所著《Designing MultiAgent Systems: Principles, Patterns, and Implementation for AI Agents》(2025)的官方配套代码仓库。仓库核…
仓库攻略
25 篇 · 25 个项目 · Agent 智能体 · spark · 评测基准
自检:双轨 ✓(机制 + 工程路径)/ ⚠️ 数字核验 3 处(85 crate / ~340K 行 / 368 组测试 / 4.61s 响应均来自仓库自述,未独立复测)/ 私域污染 SUM=0 / CJK 估算 ~1700 / verifiability:核心 URL 已 fetch,LLM 端到端实测数据仅仓库自报。 Apeireth 自称 "AGI o…
CORAL 是一个面向「自动研究 / 自动进化」场景的多智能体基础设施。它不是某个具体模型,而是把"让多个 coding agent 持续跑实验、共享笔记、互相学习、迭代解法"这件事做成一套可以一键拉起的运行时:把现有代码库喂给它,再配一个打分器(grader),CORAL 就接管剩下的活——隔离工作区、跑评估、维护共享状态、调度多 agent 协作。 原生…
AwesomeLLMsforVulnerabilityDetection 是一个社区维护的精选论文 / 项目 / Agent Skill 索引,专注于"用大语言模型做软件漏洞检测"这个交叉方向。仓库由 huhusmang 维护,README 主表只展示 2025 年及之后的论文,2024 年及之前的单独归档在 docs/papers_archive.md,分…
MisakaNet 是一个面向 AI 编程 Agent 的"失败记忆"知识库。它本身不是 Agent 框架、不是向量数据库、不是云服务,它的定位非常窄:让 Agent 在跑代码撞墙时,能搜到一条"别人已经踩过、且给出可复制修复路径"的经验。 仓库以纯 Git + Markdown + Python 标准库的形式存在(misakanetcore 是独立 PyP…
Agent Governance Toolkit (AGT) 是微软在 20252026 年推出的开源 agent runtime governance 工具箱。它不重做 agent 框架,而是在 LangChain / CrewAI / OpenAI Agents / AutoGen / Google ADK 等任意框架外,套一层"policy enfor…
NVIDIA NemoClaw 是一个 alpha 阶段的参考实现栈(reference stack),把"已经在市面上流通的 AI 智能体 CLI"包进 NVIDIA OpenShell 沙箱里跑。它的目标不是再造一个 agent,而是给"agent 已经能跑了、但我想让它跑得可控、可审计、可回滚"的场景,提供一整套安装、生命周期、网络策略、托管推理、快照…
Agent Research Copilot (ARC) 是一套面向理论物理研究的 LLMAgent 工作流,由 Yanjiao Ma、Yi Wang、Xingkai Zhang 三人署名,已发布 ChinaXiv:202606.00234(v1,202606)。它本身不是单一 CLI,而是「7 个可独立复用的 Python 包 + 一层对 coding a…
⚠️ commit 时戳:本攻略基于 main 分支 SHA c2fe93deedfd0d1bd9fe7ef0601ea1b9c20ea24a(20260505 03:23 UTC,commit message "Make serenity output example more concrete")。仓库卡片显示「最近提交 20260505」,与 API …
⚠️ commit 时戳:本攻略基于 main 分支 SHA 89f82b3a96fb3e25a357a24bfd13b16e7fe4bf4e(20260805 15:41 UTC,commit message "Merge pull request #119 … 更新特别致谢与 Star History 图片")。仓库卡片显示「Stars 4939 / 周…
一个 Agent Skill 集合,把"在终端里讲不清的复杂图表/表格/对比"从 ASCII art / monospace 字符画升级为自包含 HTML 页面或幻灯片,直接在浏览器中打开阅读。支持架构图、Mermaid 流程图、数据表、幻灯片、diff 评审、plan 对比、project recap 等多种形态。 与单一 harness 锁定不同,它同时…
claudecode 是 Anthropic 官方出品的 agentic coding tool——一个常驻终端、读懂整个代码库的编程助手。它不是单纯的代码补全(LSP/IDE inline),而是一个能自主完成多文件修改、跑命令、做 git workflow 的 agent: 一句话定位:Anthropic 的 "终端 agent 编程助手"——和 Ope…
anthropics/skills 是 Anthropic 官方维护的 Agent Skills 示例与规范仓库。所谓 "Skill"(在 Anthropic 体系里),是一个带 YAML frontmatter 的 Markdown 指令包:一个文件夹 + 一份 SKILL.md + 一组可选脚本/资源,Claude 在识别到任务匹配时会动态加载并执行它。…
mcpcontextforge(README 自称 ContextForge)是一个由 IBM 开源的 AI Gateway / Registry / Proxy:它把任意数量的 MCP(Model Context Protocol)服务器、A2A(AgenttoAgent)服务器、REST/gRPC 后端统一汇聚到一个端点后面,对 AI 客户端(Claud…
Agently(pip install agently)是一个 Python GenAI 应用开发框架,主打"让模型输出稳定可控、让 AI 服务像后端服务一样可观测、可恢复"。它的核心抽象是 AgentExecution:把一次推理涉及的 prompt、策略、Actions、Skill 绑定、process 流、TaskContext 证据、结果视图统一收口…
Apache Burr(incubating)是一个 Python 状态机框架,用来构建"会做决策的应用"——chatbot、agent、simulation、人机协作工具。它把应用建模成一张 state machine(状态机/流程图): Burr 的关键设计哲学是 "框架无关":它不规定你必须用哪个 LLM SDK、哪个 vector DB、哪个 age…
OpenLIT 是一个开源的 AI Engineering 平台,定位是"一站式把 LLM 应用从实验推到生产"。它把 OpenTelemetry 当作统一底座,向上提供 6 类核心能力: 1. 可观测性 SDK(Python / TypeScript / Go):对 50+ LLM provider、VectorDB、Agent 框架、GPU 做自动埋点(…
这是 Decoding AI 杂志社出品的开源实战课程仓库,教你从零搭建一个"Second Brain AI 助手" —— 让你的 Notion / 网页笔记 / 文档作为个人知识库,配合 agent + RAG + 微调 + LLMOps,做出一个能聊你自己的笔记的生产级 AI 助手。MIT 协议、纯 Jupyter Notebook + Python、最…
Laminar(仓库路径 lmnrai/lmnr,官方域名 laminar.sh,品牌写作"Laminar"——注意跟流体力学的层流同名)是 为 AI Agent 量身打造的开源可观测性平台,由 YC S24 孵化的团队开发,Apache2.0 协议,主仓 ~3.1k Stars、TypeScript/Rust 混合栈,最近一次 release 验证于 20…
TruLens 是 TruEra 公司(已被 Snowflake 收购)维护的、面向 LLM 实验和 AI Agent 的评估与追踪框架。它做两件事: 1. Instrumentation(埋点):用 OpenTelemetry 拦截你的 LLM / RAG / Agent 调用,把每一次 LLM 生成、检索、工具调用都落成结构化 OTEL span。 2.…
OpenViking 是字节跳动旗下火山引擎(Volcengine)开源的、面向 AI Agent 的「上下文数据库」(Context Database)。它用「文件系统范式(filesystem paradigm)」统一管理 Agent 运行所需的全部上下文:长期记忆(memory)、外部知识与资源(resources)、可调用的技能(skills)。 与…
OASIS(Open Agent Social Interaction Simulations with One Million Agents)是 CAMELAI 团队开源的"百万级 LLM Agent 社交模拟器"。它不是单 Agent 框架,也不是 Chatbot 工具,而是一个离散时间步的社交媒体沙盘:用 LLM 驱动的"虚拟用户",在仿 Twitte…
Agent Starter Pack(ASP) 是 Google Cloud 官方出的 生产级 GenAI Agent 模板项目:用 Python 包形式提供一整套「Agent + 后端 + 前端 + 部署基础设施 + 监控 + CI/CD」的项目骨架,让开发者只关心 agent 业务逻辑。 它支持多种 agent 框架 / 模式(自带模板): 重要变更:R…
mcpagent 是 Lastmile AI 开源的、专门面向 Model Context Protocol(MCP) 的 Python Agent 框架。它的基本立场是:"MCP 就够了,简单的可组合模式比花哨架构更稳"。它围绕一个 MCPApp 运行时来注册 Agent、MCP 服务器、工具和工作流,把 Anthropic 那篇「Building Eff…
Memvid 是一个"单文件 AI 记忆层"(singlefile memory layer)项目,目标是把 LLM Agent 需要的"长期记忆 + 检索"打包成一个可拷贝、可分享、可版本管理的 .mv2 文件,从而彻底替代传统 RAG 链路里的向量数据库 + 检索服务。 它用了一种"借鉴视频编码"的有趣思路:把每条记忆存为一个不可变的 Smart Fra…