Serena 是一个面向 AI 编程 Agent 的 MCP 工具包,为 Agent 提供 IDE 级别的语义代码检索、编辑、重构和调试能力。它的核心定位是"Agent 的专属 IDE"——让 Agent 能像资深开发者使用 IDE 那样,在符号(symbol)层面理解代码结构,而不是逐文件逐行地猜。 简而言之:没有 Serena,Agent 只能靠"gre…
仓库攻略
736 篇 · 726 个项目 · tom
Rowboat 是一个开源 AI 同事桌面应用,其核心卖点是"真正的记忆"——它把你的邮件、会议、Slack、笔记持续索引到一个本地知识图谱(Obsidian 风格的背链图),然后基于这份长期积累的上下文帮你完成工作。它不是每次对话从零构建上下文的 AI,而是一个会把你的工作记忆下来、越用越懂你的数字同事。 Rowboat Y Combinator S24 …
T3MP3ST(念作 "tempest")是一个自主红队平台,用多 Agent 协作把 AI 编程助手(Claude Code、Codex、Hermes)变成漏洞猎人。它的核心理念是:你已经在用的 AI 编程 Agent 就是大脑,T3MP3ST 围绕它构建一套攻击性武器库——侦察(Recon)→ 利用(Exploit)→ 报告(Report),一条龙的杀伤…
opencodexcomputeruse(项目名 opencomputeruse)是一个开源的 Computer Use 服务,以 MCP(Model Context Protocol)协议包装,让任何 AI Agent 或 MCP Client 都能在 macOS、Linux、Windows 上获得"操作电脑"的能力。 它的灵感来自 OpenAI 发布的 …
PaperSpine 是一个以"贡献为先、面向审稿人"为核心理念的学术写作系统,支持 Claude Code、Codex、OpenClaw 和 Hermes CLI 四个 AI Agent 宿主。它将学术论文写作拆解为 12 个有序阶段,每阶段有强制关卡(gate),不允许跳步,必须逐关通过才能进入下一阶段。 V4(当前版本 4.0.0)是重大升级:原本 1…
PageIndex 是一个无向量、基于推理的 RAG(检索增强生成)引擎,由 Vectify AI 开发。其核心理念是:传统向量 RAG 依赖"语义相似度"做检索,但这不等于"真正相关"——尤其在金融报告、法律文书、医疗文献等高度专业化的长文档场景,"相似"和"相关"的差距尤为明显。 PageIndex 模拟人类阅读长文档的方式——先看目录,再顺着结构找答案…
CloakBrowser 是一款"隐身 Chromium"浏览器,专为绕过反机器人检测而设计。与其他工具通过 JavaScript 注入或配置参数"伪装"成浏览器不同,CloakBrowser 在 C++ 源码层面对 Chromium 打补丁,将修改直接编译进二进制,让检测系统看到的是一个"真正的普通浏览器"——因为它本质上就是。 核心卖点:30/30 反检…
ResearchPaperWritingSkills 是一个面向 AI 编程助手(Codex、Claude Code、Gemini)的论文写作 Skill 包,将 ML/CV/NLP 学术论文的写作方法论封装为可复用指令集。 它的核心知识来源是彭思达(Prof. Peng Sida)公开的研究笔记仓库 learning_research,本仓库在此基础上做了…
ClaudeCodeGameStudios 是一个开源的 Claude Code 增强模板,旨在将"单人会话 AI 辅助"升级为"结构完整的游戏开发工作室"。 它通过预配置的 49 个专业 Agent、73 个 Slash Commands、12 个自动化 Hooks 和 11 套路径作用域代码规范,让 Claude Code 在游戏开发场景下拥有真实工作室…
AgentLearningHub 是 Datawhale 社区维护的一份AI Agent 系统化学习路线,目标是把社区里的优秀分享、官方博客、论文、开源项目和真实工程经验,整理成一份可以照着执行的 AI Agent 学习 todo list。 这不是一个代码工具仓库,而是一个学习导航仓库——README 即全部内容,作者是 Datawhale 成员陈思州(j…
PixelRAG 是一个基于视觉渲染的 RAG(检索增强生成)系统,核心思想:把文档(网页、PDF)渲染成截图切片(screenshot tiles),再对图片做向量检索,而不是解析 HTML 提取文本。传统 RAG 丢掉的表格、图表、排版信息,在 PixelRAG 里完整保留,读者模型可以直接"看"到原始视觉布局。 源自 Berkeley SkyLab、B…
PowerInfer 是由上海交大 IPADS 实验室开源的高速 LLM 推理引擎,专为单张消费级 GPU(RTX 4090 等)本地部署设计。其核心技术是利用 LLM 推理中神经元激活的幂律分布特性——少数"热神经元"(hot neurons)在几乎所有输入中都被激活,而大多数"冷神经元"(cold neurons)则随输入变化。 基于这一洞察,Power…
Deep Lake 是 AI 数据运行时(AI Data Runtime),由 Activeloop 提供。其核心定位是:专为 AI 应用设计的多模态数据库,同时支持向量检索、数据版本控制和多模态原始数据存储。 与只存 embedding 的向量数据库不同,Deep Lake 可以存任意类型的原始数据——图片、视频、音频、PDF、文本、embedding 向…
txtai 是由 NeuML 维护的一个一体化 AI 框架,核心理念是把语义搜索、LLM 编排和工作流三大能力整合在同一个 Python 包里。 其核心组件是 Embeddings 数据库——本质上是一个融合了稀疏向量索引、密集向量索引、图网络和关系数据库的统一检索层。这使得 txtai 既能做传统向量检索,也能做 SQL 查询、主题建模、图分析。 架构图:…
DeepTutor 是一个Agent 原生的个性化辅导系统,由香港大学数字智能系统实验室(HKUDS)开发,定位是让 AI tutor 真正介入学习过程、而非仅仅回答问题。它在 2025 年初的 arXiv 论文(arXiv:2604.26962)中被提出,当前最新版本为 v1.5.0(2026.7.4),处于活跃开发状态。 核心设计哲学:学习不是问答,而是…
SGLang 是一个高性能大语言模型(及多模态模型)推理 serving 框架,由 LMSYS 组织开发维护(Apache2.0 许可证)。它的核心定位是 vLLM 的直接竞争对手,在多项 benchmark 上展示出更高的吞吐量和更低的延迟。SGLang 底层基于 PyTorch,支持 RadixAttention(前缀缓存)、连续批处理(continuo…
AnythingLLM 是一个本地优先的 AllinOne AI 应用平台,用 MIT 许可证开源(JavaScript),Stars 62,686,周增 +322,已达生产就绪级别。它让用户无需重复"租用 AI 智能"——在自己的服务器或电脑上,连接任意 LLM(本地或云端),管理知识库、操作 AI Agent、构建自动化工作流。 核心定位:私有化部署的 …
anthropics/claudepluginsofficial 是 Anthropic 官方维护的 Claude Code 插件目录,收录了官方团队开发的 Internal Plugins 和经过审核的第三方 External Plugins。所有插件均可通过 Claude Code 内置的 /plugin 命令安装,提供了代码审查、特性开发、LSP 集成…
Antigravity Awesome Skills 是一个可安装的 AI Agent Skill 仓库,收录了 1,901+ 个面向主流 AI 编码助手(Claude Code、Cursor、Codex CLI、Autohand Code、Gemini CLI、Kiro、OpenCode、GitHub Copilot 等)的结构化操作手册(SKILL.md…
RAGFlow 是 InfiniFlow 出品的开源 RAG(检索增强生成)引擎,主打"深度文档理解 + 融合上下文引擎",将 RAG 与 Agent 能力结合,让大模型拥有可解释、可控的私有知识库。 核心理念:高质量输入才有高质量输出——RAGFlow 花大量精力在文档解析和切片质量上,而不是简单地把文档切成固定块塞进向量数据库。它支持可视化切片、智能重排…
ScrapeGraphAI 是一个基于 LLM 的 Python 爬虫库,用自然语言描述你想提取什么,它就能自动搞定——无需写 CSS 选择器、XPath,也无需分析网页结构。它背后的设计逻辑是把网页 scraping 当作一个有向图(Graph)来执行:LLM 作为图节点之间的"路由器",决定如何遍历页面、提取什么数据。 简单说:你告诉它要什么,它用 LL…
Mem0(发音 "memzero")是为大语言模型应用设计的通用记忆层,让 AI 记住用户偏好、对话历史和个人习惯,从而实现真正的个性化交互。与直接把历史对话塞进上下文不同,Mem0 会用 LLM 提取、理解和组织记忆,实现自我改进的长期记忆。 核心理念:Addonly(只新增,不覆盖)——记忆不断累积,Mem0 在检索时自动融合时间感知、实体链接和混合信号…
500 AI Agents Projects 是一个精选的跨行业 AI Agent 用例合集,收录 500+ 生产级 AI Agent 项目案例,覆盖医疗、金融、教育、零售、网络安全、物流等 20+ 行业,展示 AI Agent 如何重塑各行各业。 每个案例均提供GitHub 开源项目链接,可直接克隆运行。仓库同时整理了主流 Agent 框架(LangGra…
Scientific Agent Skills 是一个面向科研场景的 AI Agent Skills 集合,将任意支持 Agent Skills 标准 的 AI 编程助手(如 Claude Code、Cursor、Codex、Google Antigravity 等)扩展为「AI Scientist」——可以执行癌症基因组分析、药物虚拟筛选、分子对接、RNA…
vLLM 是一个高吞吐量、内存高效的 LLM 推理与服务引擎,最初由 UC Berkeley Sky Computing Lab 开发,现已成长为全球最活跃的开源 AI 基础设施项目之一,拥有来自 2000+ 贡献者的社区支持。 核心突破是 PagedAttention 技术——受操作系统虚拟内存分页启发,将 KV Cache 切分成小块动态管理,显著减少显…
pxpipe 是一个本地请求代理,专门用来降低 Claude Code(以及其他基于 Anthropic API 的 Agent)的 token 消耗。它通过将大量文本内容(系统提示词、工具文档、历史记录)渲染为图片,再通过视觉通道传输,从而大幅压缩输入 token 数量。 核心逻辑:一张图片的 token 成本由像素尺寸决定,而不是内容长度。实测 dens…
wloc 是一个修改 iOS 网络定位服务(WiFi/基站定位,Apple 内部称为 WLOC)的工具。它能让你在 iPhone 上"虚拟定位"——不是伪造 GPS,而是让 Apple 的网络定位服务返回你指定的坐标,从而影响依赖网络定位的 App(如地图、外卖、社交 App)。 支持 Surge、Quantumult X、Loon、Stash、Shadow…
agentmemory 是给 AI 编码代理用的持久化记忆系统。简单说:让你的 Claude Code、Codex CLI、Cursor 等代理在多次会话之间"记住"项目背景、决策历史、代码规范,不再每次从头解释。 底层基于 iii engine,不需要任何外部数据库,记忆存储在本地文件。代理每次完成任务后,agentmemory 自动把关键信息写入记忆;下…
LiteLLM 是一个统一调用 100+ 大模型 API 的 Python 库 + AI Gateway(代理服务器),用 OpenAI 格式作为统一接口,抹平各 provider(OpenAI、Anthropic、Gemini、Bedrock、Azure、HuggingFace、VLLM、NVIDIA NIM 等)的 API 差异,同时提供成本追踪、虚拟 …
aiengineeringfromscratch 是一个从数学基础到多 Agent 生产部署的系统性 AI 工程课程,包含 503 节课程、20 个阶段,覆盖 Python / TypeScript / Rust / Julia 四种语言,MIT 许可证,完全免费。 它的核心理念是 Build It Before You Use It——在学习任何框架或工具…