一个开箱即 fork 的 Claude Code 学术工作流模板,把 PhD 课程生产环境里打磨出来的 AI 辅助学术工作流打包成可复用的模板仓库。覆盖论文(LaTeX/Quarto)、幻灯片(Beamer)、数据分析(R/Python)、文献综述、Replication Package 全流程。本质是一个"AI 包工头"——你描述目标,Claude Cod…
仓库攻略
226 篇 · 222 个项目 · Agent 智能体 · tom · Agent 智能体
nonegativeecho 是一个 Agent Skills 格式的 Skill(技能插件),用于解决 Agent 在迭代修正过程中产生的「负面残留」问题——Agent 在多轮对话里否定了某些方案、尝试或措辞,但最终交付的标题、commit 信息、PR 说明里仍然残留了被否内容。 典型症状: 标题:番茄炒蛋(没有东坡肉) + 标题:番茄炒蛋 说白了:Age…
simonw/claudeskills 是知名开发者 Simon Willison 从 Claude Code Interpreter 的 /mnt/skills 目录中导出的 Anthropic Claude 技能(Skills)集合。Anthropic 在 Claude 的代码解释器环境中内置了一套技能系统,涵盖 PDF、DOCX(Word)、PPTX(…
Pinvou Agent 是一个开源桌面 AI Agent 工作空间,基于 Tauri 2 + React + Vite 构建。不是聊天窗口,而是把日常办公、视觉设计、软件开发都收进一个桌面应用——用工具、操作文件、构建个人知识库,把 prompt 变成可继续编辑的真实成果。 核心定位:让 AI agent 真正交付结果,而不只是生成一段文字。 支持本地模型…
Taskuary 是一个本地优先的 AI 任务中枢,把邮件(Outlook)、协作平台(Teams、Slack)以及 GitHub Issues 的消息汇聚到同一个时间线,由 AI 做预分类(triage),识别出哪些是真正需要处理的工作,再把任务分发给你已有的 Coding CLI(Claude Code、Codex、Gemini、Cursor、Copil…
WISP(Workspace for Intelligent Scientific Practice)是一个开源、本地优先的桌面 AI 科研工作台,将文献检索、Python/R 执行、~80 个科学数据库查询、AI 模型调用集成在一个项目中,支持 SSH/WSL/本地 GPU 多种计算后端,数据和凭证保留在本地不传云端。 AI 辅助科研工具普遍存在两个问题:…
shortvideomaker 是一个开源自动化短视频创作工具,通过文本脚本自动生成 TikTok / Instagram Reels / YouTube Shorts 风格的短视频。它同时暴露 REST API 和 MCP(Model Context Protocol) 接口,既可以配合 n8n 等工作流工具使用,也可以直接 API 调用。 它的定位是不需…
gomicro 是 Go 语言的AI Agent 运行时框架(agent harness)和微服务开发框架。它的核心定位是:把你已经在用微服务方式构建的系统,直接变成 Agent 可以调用、Agent 之间可以互操作的智能服务。 官方自称"A harness is the runtime around an agent"——harness(驾驭装置)是围绕在…
ipaslogoskill 是一个紧凑的 AI Agent 技能包(Agent Skill),专门用于生成极度简洁、可爱、适合商业使用的 IP 吉祥物图片。它遵循开放 Agent Skills 格式,可接入任何兼容的 AI 编程助手(Codex、Coze、Doubao、YouMind、Manus、Gemini Apps、Replit Agent 等),而非绑…
TUUI(Tool Unitary Utility Integration)是一个基于 Model Context Protocol(MCP)的桌面端 AI 客户端,核心定位是跨供应商 LLM API 编排 + MCP 工具集成一体化桌面工具。使用 Electron + Vue 3 + Vuetify 构建,支持 Windows/macOS/Linux。TU…
piextensions 是一个 TypeScript monorepo,为 Pi Coding Agent(一款 AI 编程助手,支持 Claude Code、Codex CLI、ChatGPT 等)提供可独立安装的扩展包生态。覆盖编程自动化、规划协作、浏览器控制、Web 研究、Git 工作流、跨供应商 API 编排、终端体验和可观测性等场景。每个包独立发…
BrowserWing 是一个浏览器自动化平台,将浏览器操作转化为 MCP 命令或 Claude Skill,让 AI Agent 通过结构化命令直接控制浏览器,而非依赖慢速、高 token 消耗的 LLM 视觉理解页面。 78 个内置脚本,覆盖 10 大分类:技术、社交、资讯、财经、娱乐、购物、求职、阅读、学术、搜索。数据以 JSON/CSV 结构化输出,…
Dust(dust.tt)是一个企业级 AI Agent 平台,帮助组织创建、部署和管理多用途 AI Agent,无需编写代码。其定位与 LangChain Agents / AutoGen 不同——Dust 强调的是「开箱即用的企业级可靠性」而非「开发者友好的代码框架」。 核心架构 primitives(Dust 2025 Blog 自述): 1. Tea…
Code Mode(@utcp/codemode)是让 AI Agent 通过执行代码而非传统 JSON toolcalling 来调用工具的库。核心思路:给 Agent 一个能写 TypeScript 代码的沙盒执行环境,Agent 在代码里直接调用 MCP/UTCP 工具,一行代码替代传统方案的 15+ 次工具调用轮次。 Apple ML、Cloudfl…
OpenBot 是 CopilotKit 于 2026 年 8 月中旬开源的 AI 同事平台,核心理念是每个 AI Agent 拥有自己专属的计算机——独立的浏览器会话、文件系统和工作区空间。所有操作先审批再执行、执行后完整记录,相当于给 AI Agent 配了一个带录像的沙盒工位,你随时可以接管。 项目定位"企业级自托管",代码 MIT 许可,但生产部署需…
PaperDebugger 是一款面向 Overleaf 的 Chrome 浏览器插件,为学术论文写作提供 AI 辅助——在编辑器内完成研究 → 批评 → 修订的完整工作流。核心驱动力是团队自研的 XtraMCP 编排引擎,通过多步骤推理实现类审稿人的结构化批评,而非简单的聊天式续写。 核心约束:只读不写——从不修改用户项目,仅读取并提供建议,隐私安全优先。…
Ante(读作「anti」)是 Antigma Labs 开源的一个自包含(selfcontained)终端编程智能体,核心定位是"Harness(工具架)优先,而非模型绑定"。作者观点鲜明:好用的 Agent 依赖的不只是模型,更是一套经过精细调校的执行框架(harness),而这套框架应该与模型解耦、可以自由替换。 一句话类比:Ante ≈ Claude…
WFGY(万法归一 / WanFaGuiYi)是一个面向 AI 推理、RAG 与 Agent 工作流的开源协议与工具生态系统。它的核心主张是:在嵌入空间(embedding space)中构建语义场定律(semantic field laws),让 LLM 能够自我收敛推理路径,减少 RAG 漂移、幻觉和"幽灵匹配"问题。 当前公开的最新版本为 WFGY 5…
herdrm 是 herdr 的原生 macOS 图形控制台。herdr 本身是一个后台服务进程,作为你所有编程 Agent 的「终端运行时」——它持有真实终端,让 Agent 的工作在你关闭笔记本盖或断网后继续运行,并知道每个 Agent 当前是工作中、阻塞中还是已完成。herdrm 则在这个运行时之上套了一层原生 macOS 窗口,让你从一台 Mac 上…
Cumora(cumora.ai)是一个AI Agent 团队协作平台,定位为"多 Agent team chat"——AI Agent 和人类共同出现在同一个通讯录、同一组对话里,Agent 不只是被动的问答机器,而是有身份(persona)、有记忆、能认领任务、相互协调而不打架的存在。 核心特点: ⚠️ 截至 202608,Cumora 处于 invit…
KiroCrew 是一个持久化 AI 开发工作空间,核心理念是"工作不随对话结束而消失"。它让 AI Agent 具备记忆、自我学习和自我进化能力,支持从桌面应用、Web Dashboard、CLI 到 Slack/Discord/Telegram 等消息渠道的多端接入。 架构上分为三层: Surface 层(入口):桌面 App、Web Dashboard…
playwrightskill 是一个通用浏览器自动化 Skill,基于 Playwright 实现,专为 AI Coding Agent 设计。它遵循开放的 Agent Skills 规范,可被 Claude Code、Cursor、GitHub Copilot、Codex、Gemini CLI、OpenCode 等主流 Coding Agent 自动发现…
gptme(发音像 "GPTmee")是一个运行在终端里的 AI 编程 Agent,配备本地工具集:写代码、执行命令、浏览网页、操作文件。你可以在自己的笔记本、SSH 会话、tmux、headless 服务器甚至 CI 流水线里运行它。定位是通用型终端 AI Agent,既是一个强大的编程助手,也可以处理各种知识工作。完全开源,支持 Anthropic、Op…
Olares(曾用名 TerminusOS)是一个开源的个人云操作系统,基于 Kubernetes 构建,旨在让你用自己的硬件(PC、服务器、NAS 或专用设备 Olares One)运行一个私有化 AI 平台。它的核心定位是:把公有云 AI 的能力(LLM 对话、AI Agent、文档知识库、多模态生成)带回家,同时保证数据完全自主可控。 Olares 2…
UltraRAG 是由清华大学 THUNLP、东北大学 NEUIR、OpenBMB、AI9stars 联合推出的低代码 RAG 开发框架,基于 MCP(Model Context Protocol)架构设计。它将 RAG 的核心组件(检索器 Retriever、生成器 Generation、语料处理 Corpus、评估 Evaluation)拆解为独立的 M…
Nasiko 是一个面向 AI Agent 的开发者控制平面(Developer Control Plane),用 Rust 编写,核心定位是:运行多个 Agent 时,用单一进程解决"谁调用谁、谁持有哪个 key、调用成本几何、为什么失败"这四个工程难题。 它基于 A2A 协议(AgenttoAgent Protocol)工作——任何讲 A2A 的 Age…
Genkit 是 Google Firebase 团队开源的全栈 AI 应用开发框架,支持 JavaScript/TypeScript(生产就绪)、Go(生产就绪)、Python(Beta)、Dart(Preview)四种语言,可对接 Google Gemini、OpenAI、Anthropic、Ollama 等主流模型厂商。 核心理念:一套 API 走天下…
CyberStrikeAI 是一个用 Go 语言编写的 AI 原生渗透测试平台,官方定位是"intent becomes governed execution"——将自然语言意图转换为可治理的渗透测试行动,同时保留完整审计轨迹。 核心架构:Go 后端 + Eino 驱动的 Agent 引擎 + MCP 原生工具 + RAG 知识库 + 可视化工作流 + 攻击…
Open Science 是一个开源、localfirst、modelagnostic 的 AI 科研工作台,由专用的 AI Agent 驱动,帮助研究者完成从文献调研、假设生成到代码执行、数据分析、可视化、报告产出的全流程,所有结果都可追溯到产生它的完整活动记录。 它的核心定位是:把大模型 Agent 变成一个可信赖的科研搭档,而非一个聊天玩具。运行在研究…
OpenMetadata 是一个开源的数据上下文层与元数据管理平台,定位为「AI 时代的数据目录 + 组织记忆 + 语义治理中枢」。它将技术元数据、数据质量信号、血缘(Lineage)、所有权、使用量、治理策略、对话记忆、业务语义(Glossary/Classification/Metrics)全部连接到一个统一的元数据知识图谱中,供人类数据团队、AI 助手…