2026 年,AI 社区出现了一个重要认知转向:Agent 的表现瓶颈不在模型本身,而在包裹模型的那层工程结构——Harness(驾驭层)。Harness 由 @omarsar0(Elvis,研究机构 DAIR.AI 联合创始人)提出,核心主张是:Agent 的工具调用行为由 Harness 决定,而非工具数量;Harness 的核心能力是决定何时不调用工具…
仓库攻略
160 篇 · 158 个项目 · Agent 智能体 · jay
ClaudePrism 是一个 本地优先的离线科学写作工作空间,由 Tauri 2(Rust)构建的原生桌面应用,集成 LaTeX 编译(嵌入式 Tectonic)、Python 科学计算环境(uv)、以及 100+ 领域专项 Claude Skills(来自 KDense Scientific Skills 项目)。简单说:它把 OpenAI Prism …
rampstackco/claudeskills 是一个 Claude Skills 技能库,包含 103 个互相组合的模块化技能,覆盖从品牌策略、设计系统、内容生产、SEO、产品管理、前端开发到增长运营的完整网站生命周期。每一个 Skill 都是一个独立文件夹,内含 SKILL.md(指令 + YAML 元数据)以及可选的参考文件(模板、清单、工作示例)。…
Google Workspace MCP Server(workspacemcp)是目前功能最完整的 Google Workspace MCP 服务器,通过 MCP(Model Context Protocol)协议将 AI 助手连接到 Google 全套生产力工具——覆盖 Gmail、Drive、Calendar、Docs、Sheets、Slides、Fo…
一个 Claude Code 插件市场 + 精选资源索引,收录 Agents(117个)、Commands(175个)、Hooks(28个)、Skills(26个)、Plugins(51个)五大类资源,帮助用户发现和安装 Claude Code 生态中的扩展包。 官方定位: "A plugin marketplace and discovery platfo…
一个 Claude Code Skill(方法论 + 配套脚本集),专注于"忠实复刻任意网站"——从单文件静态页到 WebGL 重前端,不靠 AI 臆测代码,全部走真源码逆向。 核心理念:AI 分析文档里的代码块,默认全是臆造的,必须用真源码逐行核对。作者用一个具体案例说明:一份 AI 分析把"光线球体解析交点 + SVG feDisplacementMap…
Prime Agent 是 Prime Intellect(2026 年 8 月 5 日开源)的自改进 Agent 编程框架,围绕两个核心抽象构建: RLM(Recursive Language Model):将上下文视为变量,把子 Agent 调用变成 REPL 内的函数调用(rlm(...)),替代传统的固定工具 schema + 上下文压缩方案。 Co…
PilotDeck 是一个以 WorkSpace 为核心单元的 AI Agent 操作系统,由清华大学 THUNLP、ModelBest、OpenBMB 和 AI9Stars 联合开发,2026 年 5 月 28 日正式开源。定位是"面向长时间、多项目并行 AI 生产力工作"的 Agent 平台,核心理念是把 AI Agent 从"你问我答"的单轮工具,变成…
claudeskills(v0.4.16)是面向 Claude Code 的专业技能包,内含 67 个专业化 Skill 和 9 个项目工作流,覆盖 12 个分类:语言(Python/TypeScript/Go/Rust等)、前端框架、后端框架、基础设施、云、API与架构、质量测试、DevOps、安全、数据与ML、平台专家、工作流命令。 它的核心价值是把"大…
代表攻略
VoltAgent/awesome-agent-skills · 上手攻略
VoltAgent/awesomeagentskills 是一个人工精选的 Agent Skill 合集,收录了 1000+ 来自官方开发团队与社区的高质量 Agent Skills,兼容 Claude Code、Codex、Gemini CLI、Cursor、GitHub Copilot、OpenCode、Windsurf 等主流 AI 编程工具。与批量 …
同类项目 2展开比较
同名 Awesome 仓库已合并展示,原攻略与详情链接均保留。
VoltAgent/awesome-agent-skills
Stars 29,971
代表
heilcheng/awesome-agent-skills
Stars 6,081
ICMArchitect 是一个 Claude Code 技能(Skill),用于将任何流程、想法或问题设计成 ICM 工作区——即一套文件夹结构作为 Agent 架构。它也可以把一个已有文件夹/代码库重新组织成 ICM 格式。 ICM 全称 Interpretable Context Methodology(可解释的上下文方法论),源自论文 Interpr…
本攻略核验了论文摘要、arXiv HTML 全文(2607.24280)、GitHub 仓库(README)、AI Weekly 报道及 Qwen3 官方博客中的所有关键数字与模型名称。JSON 协议字段描述、三个教师模型名称(ClaudeOpus4.6、GPT5.5、Gemini3.1Pro)及七项基准名称来自论文原文;Qwen31.7B/4B 架构参数来…
GPTImage2Skill 是一个面向 AI 编程 Agent(Claude Code、Codex、OpenClaw 等)的 GPT Image 2 提示词画廊 + Agent 技能 + CLI 三合一工具。它汇集了大量经过验证的 GPT Image 2 生成提示词,覆盖论文图表、UI 原型、海报、游戏资源、动漫、摄影、字体设计、产品图等二十多个分类,并提…
jakubkrehel/skills 是一个面向 AI 编程 Agent(Claude Code、Codex 等)的界面工程技能集合。作者 jakubkrehel 同时维护了 interfaces.dev 网站和 skills.sh 平台,该仓库将专业界面设计知识拆解为 8 个可独立或组合调用的 Agent Skill,让 AI 在生成代码时能像专业设计师一…
texttocad 是一个面向 AI 编程 Agent(Claude Code、Codex 等)的 CAD/CAE/CAM 技能库——给 AI Agent 安装这些 Skills 后,你可以用自然语言让 Agent 直接生成 STEP、STL、DXF、URDF 等工程文件,甚至驱动 3D 打印和数控加工。 项目包含 11 个独立 Skills,覆盖从"文本/…
QwenPaw 是基于 AgentScope 2.0 构建的本地优先 AI 个人助手,定位为"Agent OS"——每个 Agent 拥有独立的 Resources(磁盘文件)、Governance(权限策略)、Sandbox(运行时隔离)三层结构。它既可以完全离线运行(不依赖任何云端),也可以接入 14+ 云端模型提供商。 v2.0 于 20260710 …
本攻略核验了原帖中的所有关键数字,均来自 OSWorld 2.0 官方 GitHub(xlangai/OSWorldV2)、arXiv 论文摘要页(2606.29537)及 arXiv HTML 版本原始表格数据。Benchmark leaderboard 动态更新,当前 SOTA 已随新模型提交变化,文中标注了原始 paper 结果与最新榜单的区别。 OS…
Cameron R. Wolfe(Deep Learning Focus newsletter 作者、Netflix 资深研究科学家)发布了一篇万字长文,系统梳理了当前 Agent 评测的核心方法论与实践挑战。 传统 LLM 评测用静态问答或短对话就能完成——输入问题,输出答案,对比参考答案。但 Agent 系统是长时间运行、主动操作外部环境、与工具反复交互…
guizangpptskill 是「歸藏」开源的一个 Agent PPT 生成技能,专为 Claude Code / Codex 等 Agent 环境设计,可以将文章、观点、方法论自动生成精美的单文件 HTML 横向翻页 PPT,配图、封面、多平台封面也能一并生成。 内置两套视觉系统:Style A(电子杂志风)适合叙事和观点表达,Style B(瑞士国际主…
cangjieskill 是一个将书籍、长视频、播客、访谈等高价值内容蒸馏成可执行 Agent Skills 的方法论工具包。输入原始文本(书/视频字幕/播客文字稿),输出一个多文件 skill 仓库:包含独立的 SKILL.md 模块、触发条件、适用边界、使用方式和关联关系——而不是一篇总结文章。 作者 Kangarooking 的核心主张:知识看过/收藏…
khazixskills 是「数字生命卡兹克」作者开源的一套 AI Agent Skills 合集,遵循 Agent Skills 开放标准,可直接被 Claude Code、Codex、Qoder、Kimi Code、iFlow、CodeBuddy、Cursor 等 40+ 支持该标准的 Agent 安装加载。每个 Skill 都是一段结构化指令集,让 A…
mattpocock/skills 是 Matt Pocock(TypeScript 教学者、 前 Vercel 工程师)将自己的 .agents 目录公开的仓库,收录他在日常真实工程中使用的 Agent 技能。这些技能面向真实软件开发,而非 vibe coding,核心理念是:小型、易适配、可组合;基于数十年工程经验,适用于任何模型。 仓库规模极大(Sta…
davidondrej/skills 是一个面向 AI 编程 Agent、研究 Agent 和工作流 Agent 的可复用技能包。每个技能(skill)将一类重复性工作流打包成指令集,Agent 在任务需要时直接加载使用。与纯粹的理论框架不同,这里的技能来自 David Ondrej 本人的实际工作栈,经过真实场景验证。 仓库规模不大(Stars 3250,…
本攻略核验了 Jerry Liu 原帖中每项工程主张的来源与背景。Loop Engineering 作为 2026 年 AI 工程领域的核心实践,已有多篇高质量一手博客覆盖,以下内容以这些来源为主、原文为辅,冲突处以官方文档为准。 Loop Engineering(循环工程) 是 2026 年 AI Agent 工程领域崛起的一种新实践范式:与其让人一步步 …
StateAct 是 Salesforce AI Research(2026 年 7 月 24 日)发表的一篇 arXiv 论文提出的代码优先(codefirst)多智能体架构,核心洞察是:不要教 Agent 看截图,要让它直接读写程序状态。 传统 computeruse agent 路线是:截图 → 模型"看懂"像素 → 决定点击/输入 → 执行 → 再截…
FAEA(Frontier Agent as Embodied Agent)是一种无需任何演示数据、无需微调的机器人操控新范式——直接把现成的 LLM Agent SDK(如 Claude Agent SDK)当作机器人的"大脑",让 Agent 自己写代码、调试、再尝试,直到任务成功。 核心思路一句话:机器人策略(π)负责动,LLM Agent 负责想,各…
LongHorizonTerminalBench(LHTB)是一个评测 Agent 在长时序终端任务上持续工作能力的基准测试,2026 年 7 月由来自腾讯(Tencent HY LLM Frontier)、Lehigh University、University of Maryland、University of Georgia、University of…
ECHO(Environment Crossentropy Hybrid Objective)是一个让 CLI Agent 在 RL 训练过程中同时学习预测环境响应(terminal 输出)的混合目标函数,来自论文 arXiv:2605.24517(2026 年 5 月),由 Microsoft Research AI Frontiers 和 Prime I…
一个长期被忽视的事实是:语言模型被训练来执行动作,但从未被显式训练来建模它们所处的环境。 标准 Agent 强化学习(如 GRPO)只在动作 token 上计算梯度,用稀疏的二元结果奖励(成功/失败)驱动学习。环境中返回的所有观测——stdout、stderr、文件内容、错误信息、工具响应——虽然在 rollout 中已经存在,却不参与训练,被白白丢弃。 工…
LlamaParse Retrieval Harness(发布于 2026 年 6 月 29 日)是 LlamaIndex 在 LlamaParse Index v2 中推出的一套面向 Agent 的文档检索工具集。它不再把文档库当成一个静态向量数据库让 Agent 做一次语义搜索,而是把整个索引暴露为一组类文件系统接口——Agent 可以主动 list、g…