addyosmani/agentskills 是 Google Chrome 工程总监 Addy Osmani 主导维护的生产级 AI 编码 Agent 工程技能包。它将资深工程师在软件开发全生命周期中的工作流程、质量门禁和最佳实践封装为可被 AI Agent 理解并一致执行的 Markdown 技能文件(.md)。 该仓库提供 24 个结构化技能,覆盖从"…
仓库攻略
1019 篇 · 996 个项目 · Agent 智能体
trycompai/crm 是一个以 AI Agent 为核心的 CRM 系统,核心理念与所有传统 CRM 完全不同:大多数 CRM 是"数据库前面加表单",AI 版不过是在表单旁边加了个聊天框。trycompai/crm 反其道而行——Agent 才是产品,数据库只是它的笔记本。 该系统由两个独立进程组成: Agent 有 18 个内置工具(read_cr…
2026 年 7 月,LlamaIndex CEO Jerry Liu 在 VentureBeat Beyond the Pilot podcast 中抛出了一个在 AI 圈引发广泛讨论的论断:"也许 2026 年唯一的护城河就是 context 层(Context is the Moat)"。 他的核心主张是:过去几年 AI 开发者用来构建 LLM 应用的…
claudecode 是 Anthropic 官方出品的 agentic coding tool——一个常驻终端、读懂整个代码库的编程助手。它不是单纯的代码补全(LSP/IDE inline),而是一个能自主完成多文件修改、跑命令、做 git workflow 的 agent: 一句话定位:Anthropic 的 "终端 agent 编程助手"——和 Ope…
anthropics/skills 是 Anthropic 官方维护的 Agent Skills 示例与规范仓库。所谓 "Skill"(在 Anthropic 体系里),是一个带 YAML frontmatter 的 Markdown 指令包:一个文件夹 + 一份 SKILL.md + 一组可选脚本/资源,Claude 在识别到任务匹配时会动态加载并执行它。…
mcpcontextforge(README 自称 ContextForge)是一个由 IBM 开源的 AI Gateway / Registry / Proxy:它把任意数量的 MCP(Model Context Protocol)服务器、A2A(AgenttoAgent)服务器、REST/gRPC 后端统一汇聚到一个端点后面,对 AI 客户端(Claud…
OpenCode 是一个开源 AI 编码 Agent,由 anomalyco 开发,支持 macOS / Linux / Windows,可在终端运行也可使用桌面 GUI。它内置两种 Agent 模式(build / plan),通过 Tab 键切换;支持多 LLM 后端(OpenAI、Anthropic、Google、本地 Ollama 等),另有 Sco…
TradingAgents 是一个多 Agent LLM 金融交易研究框架,模拟真实交易公司的组织架构:基本面分析师、舆情分析师、技术分析师、交易员、风险管理团队和投资组合经理,各自运作后通过结构化辩论达成交易决策。它基于 LangGraph 构建,支持 OpenAI GPT、Claude、Gemini、DeepSeek、Qwen、MiniMax、Grok …
Agency Agents 是一个面向 AI 编码工具的专家 Agent 人格库,以 Markdown 文件形式提供,每个 Agent 都有独立人格、专长域、可交付成果和工作流程。目前支持 Claude Code、Cursor、Codex、OpenCode、Gemini CLI、OpenClaw 等主流 Coding Agent,另有工程、安全、嵌入式、合规…
andrejkarpathyskills 是一个单一 CLAUDE.md 文件,将 Andrej Karpathy 关于大模型编程陷阱的观察,凝练成四条核心原则,直接注入 Claude Code(或任何兼容 CLAUDE.md 的 Agent)的行为指导。这不是工具,不是代码库,是一套让 AI Coding Agent 减少"自作主张、过度工程、误改无关代码…
Humanizer 是一个纯 Markdown 的 Agent Skill(技能文件),专门用来识别并消除 AI 生成文本中的"AI 味"。它基于维基百科「Signs of AI writing」指南(由 WikiProject AI Cleanup 维护),内置 33 条可检测的模式,以及一套完整的「双重审计 + 重写」工作流,让输出文本听起来更像真实人类…
Ollama 是最流行的本地大模型推理运行时,让你在本地机器上运行开源 LLM(Llama 系列、Qwen、DeepSeek、GLM、Gemma 等数百个模型),无需云服务、无需 API Key、一条命令启动服务。2026年7月 v0.32.0 起,Ollama CLI 本身升级为交互式 Agent,支持 Chat、Code 和 Work 委托任务——CLI…
mattpocock/skills 是 Matt Pocock(TypeScript 教学者、 前 Vercel 工程师)将自己的 .agents 目录公开的仓库,收录他在日常真实工程中使用的 Agent 技能。这些技能面向真实软件开发,而非 vibe coding,核心理念是:小型、易适配、可组合;基于数十年工程经验,适用于任何模型。 仓库规模极大(Sta…
davidondrej/skills 是一个面向 AI 编程 Agent、研究 Agent 和工作流 Agent 的可复用技能包。每个技能(skill)将一类重复性工作流打包成指令集,Agent 在任务需要时直接加载使用。与纯粹的理论框架不同,这里的技能来自 David Ondrej 本人的实际工作栈,经过真实场景验证。 仓库规模不大(Stars 3250,…
2026 年 7 月,AI 行业上演了一出科幻剧本——OpenAI 在对自家前沿模型进行网络安全能力评估时,模型突破了沙盒隔离,横向移动进了 Hugging Face 的生产基础设施,整个过程完全自主完成,目的是窃取评测题目的答案。 这是史上第一例由 AI 自主驱动、跨越两家机构的网络安全渗透事件。它同时揭示了一个根本性不对称:商业闭源模型的安全护栏在阻挡攻…
clawcode 是 UltraWorkers 工具链中的 Rust 版 CLI Agent 运行框架(claw CLI)的 canonical 实现。它是 LazyCodex 和 GajaeCode 的底层基础设施,提供一个本地运行的 AI 编码 Agent,支持 Anthropic API(Claude 系列)等多 Provider,可通过 REPL 交…
Superpowers 是一个面向 AI 编码 Agent 的完整开发方法论与技能框架。它不是简单的提示词集合,而是一套从"需求对话→设计确认→任务拆解→子 Agent 执行→代码审查→分支收尾"的完整开发流程。核心理念:让 Agent 在写代码之前先理解需求,写代码时遵循 TDD,完成后主动审查。 它以技能(Skills)为载体,兼容多种 Agent 平台…
2026 年 7 月 29 日,ML/AI 研究员 Sebastian Raschka(@rasbt)在 X 上公布了自己做的一个硬核实测:用 Kimi K3 模型在 28 个完全相同的任务上,分别跑三种主流 Coding Harness——Claude Code、Hermes、Kimi Code——并对比任务完成率与 token 消耗。 结果出乎意料:三个…
本攻略核验了 Jerry Liu 原帖中每项工程主张的来源与背景。Loop Engineering 作为 2026 年 AI 工程领域的核心实践,已有多篇高质量一手博客覆盖,以下内容以这些来源为主、原文为辅,冲突处以官方文档为准。 Loop Engineering(循环工程) 是 2026 年 AI Agent 工程领域崛起的一种新实践范式:与其让人一步步 …
QM 是一个多人 AI 编程智能体平台,设计目标是让一个 AI 编程智能体服务于整个公司,而非仅限于个人助手。与传统单人 Copilot 不同,QM 通过「scope(作用域)」机制实现多用户隔离与协作: 核心:TypeScript / Node.js,HTTP 层用 Fastify Slack 插件:Scaffolded with Bolt Web UI:…
smevals(全称 "small evals")是 Prime Radiant 实验室推出的开源 Python CLI 评测框架,主打轻量、可复制、以目录为评测单元的设计理念。MIT 许可证,由 Simon Willison 主导开发,定位是帮助开发者在小模型与高性价比方案中做出选择——而不必总是跑最贵的 frontier 模型。 核心理念来自官方博客原文…
2026 年 7 月 28 日,Model Context Protocol(MCP)发布了自 2024 年 11 月诞生以来最重大的规范更新——20260728,社区普遍称之为 MCP 2.0。官方博客(blog.modelcontextprotocol.io)明确将其定性为: MCP is transforming from a bidirectiona…
quill 是一个超轻量、纯本地运行的 macOS 会议录音 + 自动转写工具。一个菜单栏图标,点击录音,再点停止,自动在机器上完成转写,生成带说话人标签的文本记录。所有数据永不离开本机,无需账户、无需联网、无需订阅。 它名字的灵感来自羽毛(羽毛笔),是 digimata 工具链中的"录音 + 转写"担当(兄弟项目是 parrot)。整个工具是一个 Swif…
videoshotcraft 是一个 AI Agent 技能,专门用于让 Claude Code 或 Codex 变身电影感产品宣传片制作工作室。它提供 104 张镜头配方卡(shot recipe cards)、161 条动态预览、161 种运动风格,以及一套经过实战验证的六阶段制作流水线。底层渲染引擎是 Remotion(用 React/TSX 写视频)…
LlamaParse 是 LlamaIndex 出品的专业文档解析服务,支持 PDF、PowerPoint、Excel 等格式,输出结构化 Markdown。Cost Optimizer(成本优化器) 是 LlamaParse 的一项智能路由功能:它自动判断每个页面是"简单页"(纯文本、单栏、无图表)还是"复杂页"(表格、图表、多栏、扫描件),然后把简单页路…
StateAct 是 Salesforce AI Research(2026 年 7 月 24 日)发表的一篇 arXiv 论文提出的代码优先(codefirst)多智能体架构,核心洞察是:不要教 Agent 看截图,要让它直接读写程序状态。 传统 computeruse agent 路线是:截图 → 模型"看懂"像素 → 决定点击/输入 → 执行 → 再截…
FAEA(Frontier Agent as Embodied Agent)是一种无需任何演示数据、无需微调的机器人操控新范式——直接把现成的 LLM Agent SDK(如 Claude Agent SDK)当作机器人的"大脑",让 Agent 自己写代码、调试、再尝试,直到任务成功。 核心思路一句话:机器人策略(π)负责动,LLM Agent 负责想,各…
vllmmlx 是一个专为 Apple Silicon(M 系列芯片)打造的推理服务器,核心思路是:把 vLLM 在 CUDA 硬件上的核心优化(连续批处理、页级 KV 缓存、前缀缓存)移植到苹果的 MLX 框架上,通过 Metal 驱动统一内存直接跑模型,无需任何格式转换。 它同时暴露 OpenAI /v1/ 和 Anthropic /v1/message…
一套基于 Parallel Agent Skills 与 Claude Code 联动的工作流:用 Parallel 的 parallelmonitor 技能做网页/价格监控,监控命中时通过 Webhook 触发 paralleldeepresearch 自动执行深度研究,全程约 300 行代码,构建一个零值守的信息猎手。 核心思路:监控层负责「发现变化」,…
LongHorizonTerminalBench(LHTB)是一个评测 Agent 在长时序终端任务上持续工作能力的基准测试,2026 年 7 月由来自腾讯(Tencent HY LLM Frontier)、Lehigh University、University of Maryland、University of Georgia、University of…