open·kritt 是一款自托管、开源的多 Agent 漏洞研究编排工具。它不是单点扫描器,而是一个把"提示词工作流 + Agent 执行 + 结果验证 + 报告导出"串成可复用剧本(playbook)的控制台,主要面向安全研究员与对安全敏感的开发者。 定位上,它不尝试把整个仓库直接扔给一个大模型让它"找出漏洞"——README 原话是「Pointing …
仓库攻略
433 篇 · 425 个项目 · Agent 智能体 · Agent 智能体
Ante(读作「anti」)是 Antigma Labs 开源的一个自包含(selfcontained)终端编程智能体,核心定位是"Harness(工具架)优先,而非模型绑定"。作者观点鲜明:好用的 Agent 依赖的不只是模型,更是一套经过精细调校的执行框架(harness),而这套框架应该与模型解耦、可以自由替换。 一句话类比:Ante ≈ Claude…
TrueForge 是 TrueFoundry 于 2026 年 8 月开源的 MIT 许可证 Agent Harness——运行在 LLM 周围的运行时层,把一个语言模型变成可真正跑在生产环境里的 Agent。它不挑模型、不绑云、不锁供应商,可以本地单进程(SQLite)运行,也可以 Docker Compose / Kubernetes 部署高可用集群。…
WFGY(万法归一 / WanFaGuiYi)是一个面向 AI 推理、RAG 与 Agent 工作流的开源协议与工具生态系统。它的核心主张是:在嵌入空间(embedding space)中构建语义场定律(semantic field laws),让 LLM 能够自我收敛推理路径,减少 RAG 漂移、幻觉和"幽灵匹配"问题。 当前公开的最新版本为 WFGY 5…
herdrm 是 herdr 的原生 macOS 图形控制台。herdr 本身是一个后台服务进程,作为你所有编程 Agent 的「终端运行时」——它持有真实终端,让 Agent 的工作在你关闭笔记本盖或断网后继续运行,并知道每个 Agent 当前是工作中、阻塞中还是已完成。herdrm 则在这个运行时之上套了一层原生 macOS 窗口,让你从一台 Mac 上…
wechatbotwebhook 是一个轻量、可自部署的微信个人号机器人,通过 HTTP webhook 暴露收/发消息能力,不需要企业微信认证、不需要公众号、不需要第三方平台账号。典型用法是把 n8n / Coze / 自家 AIGC 应用 / 自动化脚本的"通知 + 双向对话"接到个人微信上。 ⚠️ 项目目前基于 Web 微信协议,作者已明示:大概两天一…
MisakaNet 是一个面向 AI 编程 Agent 的"失败记忆"知识库。它本身不是 Agent 框架、不是向量数据库、不是云服务,它的定位非常窄:让 Agent 在跑代码撞墙时,能搜到一条"别人已经踩过、且给出可复制修复路径"的经验。 仓库以纯 Git + Markdown + Python 标准库的形式存在(misakanetcore 是独立 PyP…
Cumora(cumora.ai)是一个AI Agent 团队协作平台,定位为"多 Agent team chat"——AI Agent 和人类共同出现在同一个通讯录、同一组对话里,Agent 不只是被动的问答机器,而是有身份(persona)、有记忆、能认领任务、相互协调而不打架的存在。 核心特点: ⚠️ 截至 202608,Cumora 处于 invit…
ReMe("Remember Me, Refine Me")是阿里 AgentScope 团队开源的 AI Agent 记忆管理工具包:把会话、资源、产物沉淀为可读、可编辑、可搜索、可互链的 Markdown 知识库,并随 Agent 使用自演化。 核心口号是 "Memory as File, File as Memory"——一切记忆都是普通 Markdo…
KiroCrew 是一个持久化 AI 开发工作空间,核心理念是"工作不随对话结束而消失"。它让 AI Agent 具备记忆、自我学习和自我进化能力,支持从桌面应用、Web Dashboard、CLI 到 Slack/Discord/Telegram 等消息渠道的多端接入。 架构上分为三层: Surface 层(入口):桌面 App、Web Dashboard…
playwrightskill 是一个通用浏览器自动化 Skill,基于 Playwright 实现,专为 AI Coding Agent 设计。它遵循开放的 Agent Skills 规范,可被 Claude Code、Cursor、GitHub Copilot、Codex、Gemini CLI、OpenCode 等主流 Coding Agent 自动发现…
Qwen Code 是阿里巴巴 Qwen 团队开源的终端 AI 编程 Agent,对标 Anthropic 的 Claude Code。项目脱胎于 Google Gemini CLI v0.8.2(已停止同步),现发展为独立的多协议、多平台 Agent 框架,核心框架与 Qwen 模型均已开源,无供应商绑定。 其定位是「让 AI 编程能力在终端里随手可得」—…
本攻略核验了所有数字与说法:准确率来自 ExtractBench 官方论文(arXiv:2607.29677)及 GitHub README;FTX 矩阵案例来自 Jerry Liu 原文;各 tier 定价来自 ExtractBench GitHub 页;与原帖说法一致处直接引用,与官方文档冲突处以官方为准并注明。 LlamaExtract Agentic…
gptme(发音像 "GPTmee")是一个运行在终端里的 AI 编程 Agent,配备本地工具集:写代码、执行命令、浏览网页、操作文件。你可以在自己的笔记本、SSH 会话、tmux、headless 服务器甚至 CI 流水线里运行它。定位是通用型终端 AI Agent,既是一个强大的编程助手,也可以处理各种知识工作。完全开源,支持 Anthropic、Op…
Olares(曾用名 TerminusOS)是一个开源的个人云操作系统,基于 Kubernetes 构建,旨在让你用自己的硬件(PC、服务器、NAS 或专用设备 Olares One)运行一个私有化 AI 平台。它的核心定位是:把公有云 AI 的能力(LLM 对话、AI Agent、文档知识库、多模态生成)带回家,同时保证数据完全自主可控。 Olares 2…
UltraRAG 是由清华大学 THUNLP、东北大学 NEUIR、OpenBMB、AI9stars 联合推出的低代码 RAG 开发框架,基于 MCP(Model Context Protocol)架构设计。它将 RAG 的核心组件(检索器 Retriever、生成器 Generation、语料处理 Corpus、评估 Evaluation)拆解为独立的 M…
Nasiko 是一个面向 AI Agent 的开发者控制平面(Developer Control Plane),用 Rust 编写,核心定位是:运行多个 Agent 时,用单一进程解决"谁调用谁、谁持有哪个 key、调用成本几何、为什么失败"这四个工程难题。 它基于 A2A 协议(AgenttoAgent Protocol)工作——任何讲 A2A 的 Age…
Genkit 是 Google Firebase 团队开源的全栈 AI 应用开发框架,支持 JavaScript/TypeScript(生产就绪)、Go(生产就绪)、Python(Beta)、Dart(Preview)四种语言,可对接 Google Gemini、OpenAI、Anthropic、Ollama 等主流模型厂商。 核心理念:一套 API 走天下…
CyberStrikeAI 是一个用 Go 语言编写的 AI 原生渗透测试平台,官方定位是"intent becomes governed execution"——将自然语言意图转换为可治理的渗透测试行动,同时保留完整审计轨迹。 核心架构:Go 后端 + Eino 驱动的 Agent 引擎 + MCP 原生工具 + RAG 知识库 + 可视化工作流 + 攻击…
Agent Governance Toolkit (AGT) 是微软在 20252026 年推出的开源 agent runtime governance 工具箱。它不重做 agent 框架,而是在 LangChain / CrewAI / OpenAI Agents / AutoGen / Google ADK 等任意框架外,套一层"policy enfor…
NVIDIA NemoClaw 是一个 alpha 阶段的参考实现栈(reference stack),把"已经在市面上流通的 AI 智能体 CLI"包进 NVIDIA OpenShell 沙箱里跑。它的目标不是再造一个 agent,而是给"agent 已经能跑了、但我想让它跑得可控、可审计、可回滚"的场景,提供一整套安装、生命周期、网络策略、托管推理、快照…
superpowerszh 是目前最火的 AI 编程 Skills 框架 superpowers(250k+ ⭐)的中文增强版,在完整汉化 14 个上游 Skills 的基础上,新增 6 个面向中国开发者的原创 Skills,支持 23 款 AI 编程工具(上游仅支持 6 款)。从头脑风暴到代码审查,从 TDD 到调试,每个 Skill 都是经过实战验证的工…
AI Berkshire 是一套同时兼容 Claude Code 与 Codex 的价值投资研究 Skill 合集,将巴菲特、芒格、段永平、李录四位价值投资大师的方法论系统化、结构化,通过 AI Agent 实现专业级投资研究。仓库声称:一个人 + Claude Code / Codex = 一个投研团队。 核心定位不是"让 AI 告诉你买哪只股票",而是用…
Open Science 是一个开源、localfirst、modelagnostic 的 AI 科研工作台,由专用的 AI Agent 驱动,帮助研究者完成从文献调研、假设生成到代码执行、数据分析、可视化、报告产出的全流程,所有结果都可追溯到产生它的完整活动记录。 它的核心定位是:把大模型 Agent 变成一个可信赖的科研搭档,而非一个聊天玩具。运行在研究…
OpenMetadata 是一个开源的数据上下文层与元数据管理平台,定位为「AI 时代的数据目录 + 组织记忆 + 语义治理中枢」。它将技术元数据、数据质量信号、血缘(Lineage)、所有权、使用量、治理策略、对话记忆、业务语义(Glossary/Classification/Metrics)全部连接到一个统一的元数据知识图谱中,供人类数据团队、AI 助手…
OpenMausBot 是 macOS / Windows 桌面应用,将 Claude、Codex、Grok 等本地 CLI 工具封装为一个多机器人消息应用。每个机器人是一个真实运行的 AI Agent,有自己的性格、模型、记忆和可连接的 500+ 第三方应用(通过 Composio)。本质上它是 Grok Bot 的开源实现,核心思路是:把 AI Agen…
在 LangChain/LangGraph Agent 执行链中,在调用昂贵 Agent 之前插入一个轻量级分类器/路由步骤,由该步骤判断当前输入是否真的值得跑 Agent。如果分类器判定"不值得",直接返回轻量级结果(如简单回复、规则匹配、缓存结果),跳过整个 Agent 调用链路,从而节省大量 token 消耗。 核心代码模式(LangChain Exp…
DeepResearch_AI 是一个 AI 驱动的多智能体研究工作空间,基于 LangGraph + FastAPI 构建,支持两种研究模式: 1. DeepSearch(快速模式):5 个 researcher agent 并行 fanout + 聚合,约 12 分钟产出带引用的结构化网络研究报告 2. Research Mode(深度模式):25 个 …
OpenBB Open Data Platform(ODP)是面向金融分析师、量化交易员和 AI Agent 的开源数据集成平台。它的核心定位是"连接一次,多处消费"的数据中间件层:连接股票/加密/宏观/情绪等数据源,通过 Python SDK、CLI、REST API、MCP Server 等多种接口输出,供 AI Copilot、研究仪表盘和 Excel…
karpathy/autoresearch 是 Andrej Karpathy 于 2026 年 3 月开源的"AI 自主做 ML 研究"工具包。它只有 3 个核心文件、约 630 行 Python 代码,给一个 AI Agent(Claude / Codex 等)配上单 GPU LLM 训练环境,让 Agent 整夜自动做实验:修改训练代码 → 跑 5 分…