PowerInfer 是由上海交大 IPADS 实验室开源的高速 LLM 推理引擎,专为单张消费级 GPU(RTX 4090 等)本地部署设计。其核心技术是利用 LLM 推理中神经元激活的幂律分布特性——少数"热神经元"(hot neurons)在几乎所有输入中都被激活,而大多数"冷神经元"(cold neurons)则随输入变化。 基于这一洞察,Power…
仓库攻略
1131 篇 · 1115 个项目
Deep Lake 是 AI 数据运行时(AI Data Runtime),由 Activeloop 提供。其核心定位是:专为 AI 应用设计的多模态数据库,同时支持向量检索、数据版本控制和多模态原始数据存储。 与只存 embedding 的向量数据库不同,Deep Lake 可以存任意类型的原始数据——图片、视频、音频、PDF、文本、embedding 向…
txtai 是由 NeuML 维护的一个一体化 AI 框架,核心理念是把语义搜索、LLM 编排和工作流三大能力整合在同一个 Python 包里。 其核心组件是 Embeddings 数据库——本质上是一个融合了稀疏向量索引、密集向量索引、图网络和关系数据库的统一检索层。这使得 txtai 既能做传统向量检索,也能做 SQL 查询、主题建模、图分析。 架构图:…
LLaMA Factory(LlamaFactory)是一个统一的大模型微调平台,能对超过 100 种预训练 LLM 和 VLM(视觉语言模型)进行高效微调,且无需编写代码。项目发表面向 ACL 2024论文,并被广泛用于学术和工业场景。 其核心定位是:让微调大模型变得像"运行一个命令"一样简单。 从零预训练大模型成本极高,普通开发者无法承受。而直接使用通用…
BuilderIO/skills 是由 BuilderIO 维护的开源项目,提供一组面向 AI 编程 Agent 的小型、可组合技能集(skills)。与大型 Agent 框架不同,这些技能专注单一场景、即装即用,涵盖:视觉计划生成、代码差异可视化、Agent 工作审查、计划裁决、预算追踪等。每个技能都可以独立安装,也可以作为 Claude Code 插件整…
OpenWiki 是 LangChain 团队开源的 CLI 工具,专门用于为代码库自动编写和维护文档。核心理念是:让 AI 编程 Agent(Claude Code、Codex、Cursor 等)在工作时能查阅结构化文档,而不是靠记忆或大海捞针式的全库搜索。 安装后只需一条命令,OpenWiki 就会扫描代码库,生成 openwiki/ 目录下的 Mark…
Open Code Review 是阿里巴巴开源的 AI 代码审查 CLI 工具,起源于阿里内部使用了两年多的官方 AI 代码审查助手,已服务数万名开发者、发现数百万个代码缺陷。核心设计理念是「确定性工程 + LLM Agent」混合架构:对必须精准的步骤用工程逻辑保证正确性(文件选择、规则匹配、位置定位),将 Agent 的动态判断能力集中在需要灵活性的环…
avelino/awesomego 是 GitHub 上最权威的 Go 语言生态库清单,收录了 70+ 分类、数千个优质的 Go 框架、库和软件。Stars 17.7 万,是 awesome 系列中规模最大、维护最活跃的仓库之一,由巴西 Gopher @avelino 主导维护,有 2800+ 位贡献者参与。 所有条目均通过贡献指南审核,质量较高,是 Go …
HackwithGithub/AwesomeHacking 是一个面向黑客、渗透测试工程师和安全研究人员的 awesome 清单聚合仓库。它本身不是工具库,而是一个索引——收录了 50+ 个细分领域的安全 awesome 列表链接,每个子列表都链接到该领域最受欢迎的专项awesome仓库。 许可为 CC01.0(完全公共领域),Stars 11.5 万,是安…
VoltAgent/awesomedesignmd 是一个各知名品牌设计系统的 DESIGN.md 文件合集,收录了 40+ 主流产品(AI 平台、设计工具、数据库、SaaS 等)的设计规范分析文档。每个 DESIGN.md 都是纯文本格式的设计系统文档,AI coding agent 可以直接读取并生成风格一致的 UI 界面。 项目灵感来自 Google …
DeepTutor 是一个Agent 原生的个性化辅导系统,由香港大学数字智能系统实验室(HKUDS)开发,定位是让 AI tutor 真正介入学习过程、而非仅仅回答问题。它在 2025 年初的 arXiv 论文(arXiv:2604.26962)中被提出,当前最新版本为 v1.5.0(2026.7.4),处于活跃开发状态。 核心设计哲学:学习不是问答,而是…
tasteskill 是 Leonxlnx 开发的AI Agent 前端设计增强技能库(AntiSlop Frontend Framework for AI Agents),目标是阻止 AI 生成那种"千篇一律、毫无灵魂"的界面——官方称之为 slop(AI 垃圾内容)。 它不是一个前端框架,而是一套可移植的 Skill 指令集,安装后让 AI Coding…
systempromptsleaks 是一个持续更新的系统提示词(System Prompt)档案库,作者通过各种公开途径(网页快照、API 探测、官方文档交叉验证等)收集并归档了全球主要 AI 产品和 Agent 工具的系统级提示词。 这里的"leak"并非指黑客入侵,而是指产品公开可见或用户可观察到的系统指令被系统性地记录下来。仓库覆盖 Anthropi…
SGLang 是一个高性能大语言模型(及多模态模型)推理 serving 框架,由 LMSYS 组织开发维护(Apache2.0 许可证)。它的核心定位是 vLLM 的直接竞争对手,在多项 benchmark 上展示出更高的吞吐量和更低的延迟。SGLang 底层基于 PyTorch,支持 RadixAttention(前缀缓存)、连续批处理(continuo…
CAMEL(camelai/camel)是首个专注多 Agent 系统研究的开源框架,自称"Finding the Scaling Law of Agents"。它不是单 Agent 工具,而是一个用于构建、运行和分析大规模多 Agent 系统的平台级框架,官方定位是研究框架,支持模拟最多 100 万个 Agent 同时运行。CAMEL 背后是一个 100+…
Kilo(kilocode)是一站式开源编程 Agent 平台,自称"the most popular open source coding agent"。它脱胎于 OpenCode,在其基础上扩展为完整的多端编程助手——支持 VS Code、JetBrains、CLI 三端运行,对接 500+ 大模型,可中途切换模型,按模型提供商定价(零溢价)。另有配套平…
AnythingLLM 是一个本地优先的 AllinOne AI 应用平台,用 MIT 许可证开源(JavaScript),Stars 62,686,周增 +322,已达生产就绪级别。它让用户无需重复"租用 AI 智能"——在自己的服务器或电脑上,连接任意 LLM(本地或云端),管理知识库、操作 AI Agent、构建自动化工作流。 核心定位:私有化部署的 …
anthropics/claudepluginsofficial 是 Anthropic 官方维护的 Claude Code 插件目录,收录了官方团队开发的 Internal Plugins 和经过审核的第三方 External Plugins。所有插件均可通过 Claude Code 内置的 /plugin 命令安装,提供了代码审查、特性开发、LSP 集成…
Antigravity Awesome Skills 是一个可安装的 AI Agent Skill 仓库,收录了 1,901+ 个面向主流 AI 编码助手(Claude Code、Cursor、Codex CLI、Autohand Code、Gemini CLI、Kiro、OpenCode、GitHub Copilot 等)的结构化操作手册(SKILL.md…
CrewAI 是一个用于编排角色扮演、自主 AI Agent 的 Python 框架,通过促进协作式智能,让多个 Agent 无缝协作处理复杂任务。它的定位是「让开发者从第一天起就能构建生产级多 Agent 工作流」。 CrewAI 有两个核心抽象: 两者可以组合使用——Flow 中调用 Crew,Crew 中嵌入 Flows。 截至 2026 年 6 月最…
RAGFlow 是 InfiniFlow 出品的开源 RAG(检索增强生成)引擎,主打"深度文档理解 + 融合上下文引擎",将 RAG 与 Agent 能力结合,让大模型拥有可解释、可控的私有知识库。 核心理念:高质量输入才有高质量输出——RAGFlow 花大量精力在文档解析和切片质量上,而不是简单地把文档切成固定块塞进向量数据库。它支持可视化切片、智能重排…
ScrapeGraphAI 是一个基于 LLM 的 Python 爬虫库,用自然语言描述你想提取什么,它就能自动搞定——无需写 CSS 选择器、XPath,也无需分析网页结构。它背后的设计逻辑是把网页 scraping 当作一个有向图(Graph)来执行:LLM 作为图节点之间的"路由器",决定如何遍历页面、提取什么数据。 简单说:你告诉它要什么,它用 LL…
Mem0(发音 "memzero")是为大语言模型应用设计的通用记忆层,让 AI 记住用户偏好、对话历史和个人习惯,从而实现真正的个性化交互。与直接把历史对话塞进上下文不同,Mem0 会用 LLM 提取、理解和组织记忆,实现自我改进的长期记忆。 核心理念:Addonly(只新增,不覆盖)——记忆不断累积,Mem0 在检索时自动融合时间感知、实体链接和混合信号…
PaddleOCR 是百度飞桨(PaddlePaddle)团队开源的多功能 OCR 与文档解析工具包,GitHub Stars 超 8.4 万,被 Dify、RAGFlow、Cherry Studio 等主流项目深度集成。它不只是一套光学字符识别引擎,更是一个覆盖"图片→结构化数据"完整流程的文档 AI 基础设施。 当前稳定版本为 PaddleOCR 3.6…
500 AI Agents Projects 是一个精选的跨行业 AI Agent 用例合集,收录 500+ 生产级 AI Agent 项目案例,覆盖医疗、金融、教育、零售、网络安全、物流等 20+ 行业,展示 AI Agent 如何重塑各行各业。 每个案例均提供GitHub 开源项目链接,可直接克隆运行。仓库同时整理了主流 Agent 框架(LangGra…
Scientific Agent Skills 是一个面向科研场景的 AI Agent Skills 集合,将任意支持 Agent Skills 标准 的 AI 编程助手(如 Claude Code、Cursor、Codex、Google Antigravity 等)扩展为「AI Scientist」——可以执行癌症基因组分析、药物虚拟筛选、分子对接、RNA…
vLLM 是一个高吞吐量、内存高效的 LLM 推理与服务引擎,最初由 UC Berkeley Sky Computing Lab 开发,现已成长为全球最活跃的开源 AI 基础设施项目之一,拥有来自 2000+ 贡献者的社区支持。 核心突破是 PagedAttention 技术——受操作系统虚拟内存分页启发,将 KV Cache 切分成小块动态管理,显著减少显…
OpenCLI 是一个把任意网站变成 CLI 命令的工具,同时支持在你的已登录浏览器上跑 Browser Use,让 AI Agent(Claude Code、Cursor 等)直接操作你浏览器里的网页。 三层核心能力: 1. 现成适配器:B站、知乎、小红书、Twitter/X、Reddit、HackerNews 等 100+ 站点,开箱即用的 CLI 命令…
torlink 是一款运行在终端里的 torrent 搜索与下载工具,主打零配置、零设置。输入一次搜索词,同时查询多个精选可信来源,结果实时流入,按文件大小和做种人数标注,让你一眼看出哪个能快速下载。选中后直接下载到本地,任务在后台运行,完成后自动开始做种。 核心定位:解决找 torrent 过程中的痛苦——假按钮、弹窗广告、死链、零做种——用一个干净的全键…
ianxiaoheiillustrations 是一个面向 AI Agent(尤其是 Codex)的中文正文配图生成 Skill。它指导 AI 把中文文章、帖子、博客、方法论内容里的判断、流程、状态和隐喻,转化成一张张白底、手绘、怪诞但清爽的 16:9 正文配图。 核心特点:生成的不是通用插画 prompt,也不是 PPT 信息图模板,而是先理解文章认知锚点…