LearnPrompt 是一个永久免费开源的中文 AI 学习教程仓库,由 B站 up 主"卡尔的AI沃茨"(GitHub @LearnPrompt)维护。它起步于 2023 年的 AIGC 工具教程(ChatGPT、Midjourney、Stable Diffusion),如今已演化为一套面向真实工作场景的 AI Native 教程体系,涵盖 Claude …
仓库攻略
688 篇 · 674 个项目 · Agent 智能体
Cumora(cumora.ai)是一个AI Agent 团队协作平台,定位为"多 Agent team chat"——AI Agent 和人类共同出现在同一个通讯录、同一组对话里,Agent 不只是被动的问答机器,而是有身份(persona)、有记忆、能认领任务、相互协调而不打架的存在。 核心特点: ⚠️ 截至 202608,Cumora 处于 invit…
一份持续更新的 AI 工程面试题库,由印度理工学院(IIT BHU)校友 Amit Shekhar 创建,配套其在线课程平台 Outcome School。仓库收录了 AI Engineer、Gen AI Engineer、LLM Engineer、Agentic AI Engineer、AI Platform Engineer、MLOps/LLMOps E…
Astrid 是一个能力安全(capabilitysecure)操作系统运行时,专为可组合软件设计。它将 AI Agent 视为"不受信任的代码"——在传统框架里,Agent 拥有你本地文件的读写权限、网络访问权和凭证,而 Astrid 通过 OS 级别的安全边界来约束它,即使 Agent 被越狱、注入了恶意工具或存在 bug,也无法突破其能力授权去访问未明…
代表攻略
无需微调:VLM 调度层填平"编排差距",真实机器人 16.7% → 97.3% · 干货攻略
Pigey(Physical Agency orchestrator)是一个闭环 VLM 调度层,驱动已有的冻结机器人技能(frozen skills),无需任何新数据或微调,即可在仿真和真实机器人上大幅提升推理密集型任务的成功率。 核心论文:"Addressing the Orchestration Gap in Generalist Robots via…
ReMe("Remember Me, Refine Me")是阿里 AgentScope 团队开源的 AI Agent 记忆管理工具包:把会话、资源、产物沉淀为可读、可编辑、可搜索、可互链的 Markdown 知识库,并随 Agent 使用自演化。 核心口号是 "Memory as File, File as Memory"——一切记忆都是普通 Markdo…
KiroCrew 是一个持久化 AI 开发工作空间,核心理念是"工作不随对话结束而消失"。它让 AI Agent 具备记忆、自我学习和自我进化能力,支持从桌面应用、Web Dashboard、CLI 到 Slack/Discord/Telegram 等消息渠道的多端接入。 架构上分为三层: Surface 层(入口):桌面 App、Web Dashboard…
playwrightskill 是一个通用浏览器自动化 Skill,基于 Playwright 实现,专为 AI Coding Agent 设计。它遵循开放的 Agent Skills 规范,可被 Claude Code、Cursor、GitHub Copilot、Codex、Gemini CLI、OpenCode 等主流 Coding Agent 自动发现…
Qwen Code 是阿里巴巴 Qwen 团队开源的终端 AI 编程 Agent,对标 Anthropic 的 Claude Code。项目脱胎于 Google Gemini CLI v0.8.2(已停止同步),现发展为独立的多协议、多平台 Agent 框架,核心框架与 Qwen 模型均已开源,无供应商绑定。 其定位是「让 AI 编程能力在终端里随手可得」—…
代表攻略
LlamaExtract Agentic Plus:超大规模文档结构化提取实战指南 · 干货攻略
本攻略核验了所有数字与说法:准确率来自 ExtractBench 官方论文(arXiv:2607.29677)及 GitHub README;FTX 矩阵案例来自 Jerry Liu 原文;各 tier 定价来自 ExtractBench GitHub 页;与原帖说法一致处直接引用,与官方文档冲突处以官方为准并注明。 LlamaExtract Agentic…
Pezzo 是一个开源的、开发者优先的 LLMOps 平台,旨在简化 AI 应用开发中的提示词设计、版本管理、即时发布、协作、问题排查和可观测性。核心价值是帮助开发团队在生产环境中高效管理 AI 提示词的生命周期,同时通过缓存等机制节省成本(官方称最高节省 90%)。 平台分为两部分:Pezzo Console(Web UI 控制台)和 Pezzo Clie…
gptme(发音像 "GPTmee")是一个运行在终端里的 AI 编程 Agent,配备本地工具集:写代码、执行命令、浏览网页、操作文件。你可以在自己的笔记本、SSH 会话、tmux、headless 服务器甚至 CI 流水线里运行它。定位是通用型终端 AI Agent,既是一个强大的编程助手,也可以处理各种知识工作。完全开源,支持 Anthropic、Op…
DSH Desktop(DeepSeek Harness Desktop)是将 DeepSeek 官方 CLI 工具 dsh(DeepSeek Harness)封装为开箱即用桌面客户端的项目。打包内置完整 Node.js 运行时 + npm CLI + 全部官方插件,双击即启动 dsh web UI,无需用户自行安装任何环境。适合不想折腾命令行、直接在 Wi…
DiGbench(Discovery in Games)是 2026 年 8 月 12 日由 James C.R. Whittington(牛津大学)联合多位学者发布的新型 AI 评测基准,全称 Discovery in Games。 核心设计:70 个纯文本互动游戏,每个游戏内部有隐藏的「变换规则」,AI 智能体必须通过主动交互和实验来发现这些规则,然后将…
Olares(曾用名 TerminusOS)是一个开源的个人云操作系统,基于 Kubernetes 构建,旨在让你用自己的硬件(PC、服务器、NAS 或专用设备 Olares One)运行一个私有化 AI 平台。它的核心定位是:把公有云 AI 的能力(LLM 对话、AI Agent、文档知识库、多模态生成)带回家,同时保证数据完全自主可控。 Olares 2…
UltraRAG 是由清华大学 THUNLP、东北大学 NEUIR、OpenBMB、AI9stars 联合推出的低代码 RAG 开发框架,基于 MCP(Model Context Protocol)架构设计。它将 RAG 的核心组件(检索器 Retriever、生成器 Generation、语料处理 Corpus、评估 Evaluation)拆解为独立的 M…
Nasiko 是一个面向 AI Agent 的开发者控制平面(Developer Control Plane),用 Rust 编写,核心定位是:运行多个 Agent 时,用单一进程解决"谁调用谁、谁持有哪个 key、调用成本几何、为什么失败"这四个工程难题。 它基于 A2A 协议(AgenttoAgent Protocol)工作——任何讲 A2A 的 Age…
Genkit 是 Google Firebase 团队开源的全栈 AI 应用开发框架,支持 JavaScript/TypeScript(生产就绪)、Go(生产就绪)、Python(Beta)、Dart(Preview)四种语言,可对接 Google Gemini、OpenAI、Anthropic、Ollama 等主流模型厂商。 核心理念:一套 API 走天下…
CyberStrikeAI 是一个用 Go 语言编写的 AI 原生渗透测试平台,官方定位是"intent becomes governed execution"——将自然语言意图转换为可治理的渗透测试行动,同时保留完整审计轨迹。 核心架构:Go 后端 + Eino 驱动的 Agent 引擎 + MCP 原生工具 + RAG 知识库 + 可视化工作流 + 攻击…
AudioGPT是由 AIGCAudio 团队开源的多模态音频理解和生成框架,发布于 2023 年 4 月(arXiv:2304.12995)。其核心设计思路是:将 LLM(大语言模型)作为音频任务的统一调度层,底层对接各类音频/语音专有的预训练基础模型(Foundation Models),用户通过自然语言 Prompt 控制音频生成与理解任务。 GitH…
Agent Governance Toolkit (AGT) 是微软在 20252026 年推出的开源 agent runtime governance 工具箱。它不重做 agent 框架,而是在 LangChain / CrewAI / OpenAI Agents / AutoGen / Google ADK 等任意框架外,套一层"policy enfor…
NVIDIA NemoClaw 是一个 alpha 阶段的参考实现栈(reference stack),把"已经在市面上流通的 AI 智能体 CLI"包进 NVIDIA OpenShell 沙箱里跑。它的目标不是再造一个 agent,而是给"agent 已经能跑了、但我想让它跑得可控、可审计、可回滚"的场景,提供一整套安装、生命周期、网络策略、托管推理、快照…
superpowerszh 是目前最火的 AI 编程 Skills 框架 superpowers(250k+ ⭐)的中文增强版,在完整汉化 14 个上游 Skills 的基础上,新增 6 个面向中国开发者的原创 Skills,支持 23 款 AI 编程工具(上游仅支持 6 款)。从头脑风暴到代码审查,从 TDD 到调试,每个 Skill 都是经过实战验证的工…
AI Berkshire 是一套同时兼容 Claude Code 与 Codex 的价值投资研究 Skill 合集,将巴菲特、芒格、段永平、李录四位价值投资大师的方法论系统化、结构化,通过 AI Agent 实现专业级投资研究。仓库声称:一个人 + Claude Code / Codex = 一个投研团队。 核心定位不是"让 AI 告诉你买哪只股票",而是用…
2026 年 8 月 10 日,一支由 8 位安全研究者组成的团队(包括来自 ELLIS Institute Tübingen、Max Planck Institute for Intelligent Systems、MATS Research 等机构的学者)在 arXiv 上发表了一篇震惊业界的论文:"Stealing Reasoning Traces f…
dshai4scholar 是 DeepSeek Harness(dsh)的官方学术文献插件,提供 38 个原生 Agent 工具,覆盖文献检索、全文获取、引用管理、科学图表生成等科研写作全流程。 它本质上是一个 Node.js 包(dsh 插件),安装后在 dsh web 界面中注册 38 个工具,并通过 ai4scholar.net 的 API 接入 S…
Open Science 是一个开源、localfirst、modelagnostic 的 AI 科研工作台,由专用的 AI Agent 驱动,帮助研究者完成从文献调研、假设生成到代码执行、数据分析、可视化、报告产出的全流程,所有结果都可追溯到产生它的完整活动记录。 它的核心定位是:把大模型 Agent 变成一个可信赖的科研搭档,而非一个聊天玩具。运行在研究…
OpenMetadata 是一个开源的数据上下文层与元数据管理平台,定位为「AI 时代的数据目录 + 组织记忆 + 语义治理中枢」。它将技术元数据、数据质量信号、血缘(Lineage)、所有权、使用量、治理策略、对话记忆、业务语义(Glossary/Classification/Metrics)全部连接到一个统一的元数据知识图谱中,供人类数据团队、AI 助手…
Vanna 是一个基于检索增强生成(RAG)的 TexttoSQL 开源框架,帮助开发者用自然语言查询 SQL 数据库。v2.0 是完全重写版本(与 v0.x 不兼容),核心定位从「RAG + LLM 生成 SQL」升级为「面向企业的用户感知型数据分析 Agent 平台」——每个组件都知道当前操作用户是谁,并自动做行级别权限过滤。 核心能力: Stars:约…
OpenMausBot 是 macOS / Windows 桌面应用,将 Claude、Codex、Grok 等本地 CLI 工具封装为一个多机器人消息应用。每个机器人是一个真实运行的 AI Agent,有自己的性格、模型、记忆和可连接的 500+ 第三方应用(通过 Composio)。本质上它是 Grok Bot 的开源实现,核心思路是:把 AI Agen…