TrendRadar 是一款开源 AI 舆情监控与热点聚合工具(v6.10.0,MCP v4.1.0),用 Python 开发,遵循 GPL3.0 协议。它能自动抓取多平台热搜、整合 RSS 订阅源,通过 AI 智能筛选新闻、翻译内容、生成分析简报,并推送至微信/飞书/钉钉/Telegram/邮件等渠道。简单说:它帮你把"信息过载"变成"精准推送"。 核心解…
仓库攻略
551 篇 · 545 个项目 · LLM 基础设施
CowAgent 是一个开源超级 AI 助手框架,原名 chatgptonwechat,定位于「Agent Harness」(AI Agent 编排框架)。它将 AI 助手从简单的对话机器人提升为一个能主动规划任务、操作电脑与外部服务、构建个人知识库与长期记忆、并通过自演化不断成长的智能体。 核心设计哲学:消息通过 Channels 流入,由 Agent C…
AirLLM 是一个开源 Python 库,实现了一种层间加载(layerwise)推理技术,让超大语言模型在显存极小的 GPU(甚至只有 4GB VRAM 的卡)上运行推理,无需量化、无需蒸馏、无需剪枝。 核心技术原理:用单层加载替代全量加载。传统推理需要把 130GB 的 70B 模型一股脑塞进显存;AirLLM 把模型按 transformer 层拆开…
Bifrost 是一个高性能企业级 AI Gateway(AI 网关),用 Go 语言编写,核心卖点是通过单一 OpenAI 兼容 API 统一接入 23+ 家 AI 提供商,并自带自适应负载均衡、自动故障转移、语义缓存、Guardrails、MCP Gateway 等企业级功能。 官方宣称在 5,000 RPS 持续压测下,网关额外延迟仅 ~11 µs(t…
Rowboat 是一个开源 AI 同事桌面应用,其核心卖点是"真正的记忆"——它把你的邮件、会议、Slack、笔记持续索引到一个本地知识图谱(Obsidian 风格的背链图),然后基于这份长期积累的上下文帮你完成工作。它不是每次对话从零构建上下文的 AI,而是一个会把你的工作记忆下来、越用越懂你的数字同事。 Rowboat Y Combinator S24 …
T3MP3ST(念作 "tempest")是一个自主红队平台,用多 Agent 协作把 AI 编程助手(Claude Code、Codex、Hermes)变成漏洞猎人。它的核心理念是:你已经在用的 AI 编程 Agent 就是大脑,T3MP3ST 围绕它构建一套攻击性武器库——侦察(Recon)→ 利用(Exploit)→ 报告(Report),一条龙的杀伤…
AccumulateMore/CV 是一个中文深度学习全栈笔记库,覆盖 PyTorch 基础、李沐《动手学深度学习》、吴恩达 Deep Learning 系列,以及大模型 Agent 方向(土堆/李沐/吴恩达/大飞四位主讲人的视频对应笔记)。以 Jupyter Notebook(.ipynb)格式为主,已声明"已完结"状态(400+ 笔记区间)。Stars …
PageIndex 是一个无向量、基于推理的 RAG(检索增强生成)引擎,由 Vectify AI 开发。其核心理念是:传统向量 RAG 依赖"语义相似度"做检索,但这不等于"真正相关"——尤其在金融报告、法律文书、医疗文献等高度专业化的长文档场景,"相似"和"相关"的差距尤为明显。 PageIndex 模拟人类阅读长文档的方式——先看目录,再顺着结构找答案…
vinta/awesomepython 是 GitHub 上最知名、最全面的 Python 生态资源精选列表,由 Vinta Software 维护。该列表对标 Python 领域的各类框架、库、工具和资源,以「精选 + 有观点」为标准进行 curation,而非简单罗列。 截至 2026 年 7 月,该仓库拥有 306,828 Stars(GitHub 全…
Toonflow(动画流)是一款开源一站式 AI 短剧创作工具,将小说或剧本快速转化为动画短剧。集成 AI 编剧(ScriptAgent)、智能分镜(ProductionAgent)、角色管理和视频生成,覆盖"策划 → 编剧 → 分镜 → 出片"全流程,官方称创作效率提升 10 倍以上。 官网: 文档: 内置详细说明) 传统短剧制作流程需要:编剧改编 → 分…
wshobson/agents 是一个面向 AI 编程 Agent 的插件式市场(Plugin Marketplace),特点是从一份 Markdown 源码同时生成五套主流 Agent 平台的原生插件包:一套源码,Claude Code / Codex CLI / Cursor / OpenCode / Gemini CLI / GitHub Copilo…
WeKnora(维娜拉) 是腾讯开源的企业级 LLM 知识管理框架,定位是"让文档活起来":把散落在各处的 PDF、Word、飞书文档、Notion 页面变成可查询、可推理、可持续更新的知识资产。 核心三大能力: | 能力 | 说明 | ||| | RAG 快速问答 | 基于文档知识库的精准问答,适合日常知识查询 | | ReAct Agent | 自主编排…
hesreallyhim/awesomeclaudecode 是目前最全面的 Claude Code 生态资源列表,由社区维护,精选收录了与 Anthropic 出品的 AI 编程助手 Claude Code 相关的优质 skills、hooks、slash commands、agent orchestrators、应用与插件。 它不是一个工具,而是一本生态…
PowerInfer 是由上海交大 IPADS 实验室开源的高速 LLM 推理引擎,专为单张消费级 GPU(RTX 4090 等)本地部署设计。其核心技术是利用 LLM 推理中神经元激活的幂律分布特性——少数"热神经元"(hot neurons)在几乎所有输入中都被激活,而大多数"冷神经元"(cold neurons)则随输入变化。 基于这一洞察,Power…
Deep Lake 是 AI 数据运行时(AI Data Runtime),由 Activeloop 提供。其核心定位是:专为 AI 应用设计的多模态数据库,同时支持向量检索、数据版本控制和多模态原始数据存储。 与只存 embedding 的向量数据库不同,Deep Lake 可以存任意类型的原始数据——图片、视频、音频、PDF、文本、embedding 向…
txtai 是由 NeuML 维护的一个一体化 AI 框架,核心理念是把语义搜索、LLM 编排和工作流三大能力整合在同一个 Python 包里。 其核心组件是 Embeddings 数据库——本质上是一个融合了稀疏向量索引、密集向量索引、图网络和关系数据库的统一检索层。这使得 txtai 既能做传统向量检索,也能做 SQL 查询、主题建模、图分析。 架构图:…
LLaMA Factory(LlamaFactory)是一个统一的大模型微调平台,能对超过 100 种预训练 LLM 和 VLM(视觉语言模型)进行高效微调,且无需编写代码。项目发表面向 ACL 2024论文,并被广泛用于学术和工业场景。 其核心定位是:让微调大模型变得像"运行一个命令"一样简单。 从零预训练大模型成本极高,普通开发者无法承受。而直接使用通用…
OpenWiki 是 LangChain 团队开源的 CLI 工具,专门用于为代码库自动编写和维护文档。核心理念是:让 AI 编程 Agent(Claude Code、Codex、Cursor 等)在工作时能查阅结构化文档,而不是靠记忆或大海捞针式的全库搜索。 安装后只需一条命令,OpenWiki 就会扫描代码库,生成 openwiki/ 目录下的 Mark…
Open Code Review 是阿里巴巴开源的 AI 代码审查 CLI 工具,起源于阿里内部使用了两年多的官方 AI 代码审查助手,已服务数万名开发者、发现数百万个代码缺陷。核心设计理念是「确定性工程 + LLM Agent」混合架构:对必须精准的步骤用工程逻辑保证正确性(文件选择、规则匹配、位置定位),将 Agent 的动态判断能力集中在需要灵活性的环…
HackwithGithub/AwesomeHacking 是一个面向黑客、渗透测试工程师和安全研究人员的 awesome 清单聚合仓库。它本身不是工具库,而是一个索引——收录了 50+ 个细分领域的安全 awesome 列表链接,每个子列表都链接到该领域最受欢迎的专项awesome仓库。 许可为 CC01.0(完全公共领域),Stars 11.5 万,是安…
DeepTutor 是一个Agent 原生的个性化辅导系统,由香港大学数字智能系统实验室(HKUDS)开发,定位是让 AI tutor 真正介入学习过程、而非仅仅回答问题。它在 2025 年初的 arXiv 论文(arXiv:2604.26962)中被提出,当前最新版本为 v1.5.0(2026.7.4),处于活跃开发状态。 核心设计哲学:学习不是问答,而是…
SGLang 是一个高性能大语言模型(及多模态模型)推理 serving 框架,由 LMSYS 组织开发维护(Apache2.0 许可证)。它的核心定位是 vLLM 的直接竞争对手,在多项 benchmark 上展示出更高的吞吐量和更低的延迟。SGLang 底层基于 PyTorch,支持 RadixAttention(前缀缓存)、连续批处理(continuo…
CAMEL(camelai/camel)是首个专注多 Agent 系统研究的开源框架,自称"Finding the Scaling Law of Agents"。它不是单 Agent 工具,而是一个用于构建、运行和分析大规模多 Agent 系统的平台级框架,官方定位是研究框架,支持模拟最多 100 万个 Agent 同时运行。CAMEL 背后是一个 100+…
AnythingLLM 是一个本地优先的 AllinOne AI 应用平台,用 MIT 许可证开源(JavaScript),Stars 62,686,周增 +322,已达生产就绪级别。它让用户无需重复"租用 AI 智能"——在自己的服务器或电脑上,连接任意 LLM(本地或云端),管理知识库、操作 AI Agent、构建自动化工作流。 核心定位:私有化部署的 …
CrewAI 是一个用于编排角色扮演、自主 AI Agent 的 Python 框架,通过促进协作式智能,让多个 Agent 无缝协作处理复杂任务。它的定位是「让开发者从第一天起就能构建生产级多 Agent 工作流」。 CrewAI 有两个核心抽象: 两者可以组合使用——Flow 中调用 Crew,Crew 中嵌入 Flows。 截至 2026 年 6 月最…
RAGFlow 是 InfiniFlow 出品的开源 RAG(检索增强生成)引擎,主打"深度文档理解 + 融合上下文引擎",将 RAG 与 Agent 能力结合,让大模型拥有可解释、可控的私有知识库。 核心理念:高质量输入才有高质量输出——RAGFlow 花大量精力在文档解析和切片质量上,而不是简单地把文档切成固定块塞进向量数据库。它支持可视化切片、智能重排…
ScrapeGraphAI 是一个基于 LLM 的 Python 爬虫库,用自然语言描述你想提取什么,它就能自动搞定——无需写 CSS 选择器、XPath,也无需分析网页结构。它背后的设计逻辑是把网页 scraping 当作一个有向图(Graph)来执行:LLM 作为图节点之间的"路由器",决定如何遍历页面、提取什么数据。 简单说:你告诉它要什么,它用 LL…
Mem0(发音 "memzero")是为大语言模型应用设计的通用记忆层,让 AI 记住用户偏好、对话历史和个人习惯,从而实现真正的个性化交互。与直接把历史对话塞进上下文不同,Mem0 会用 LLM 提取、理解和组织记忆,实现自我改进的长期记忆。 核心理念:Addonly(只新增,不覆盖)——记忆不断累积,Mem0 在检索时自动融合时间感知、实体链接和混合信号…
PaddleOCR 是百度飞桨(PaddlePaddle)团队开源的多功能 OCR 与文档解析工具包,GitHub Stars 超 8.4 万,被 Dify、RAGFlow、Cherry Studio 等主流项目深度集成。它不只是一套光学字符识别引擎,更是一个覆盖"图片→结构化数据"完整流程的文档 AI 基础设施。 当前稳定版本为 PaddleOCR 3.6…
vLLM 是一个高吞吐量、内存高效的 LLM 推理与服务引擎,最初由 UC Berkeley Sky Computing Lab 开发,现已成长为全球最活跃的开源 AI 基础设施项目之一,拥有来自 2000+ 贡献者的社区支持。 核心突破是 PagedAttention 技术——受操作系统虚拟内存分页启发,将 KV Cache 切分成小块动态管理,显著减少显…