DeepSeek Harness(dsh) 是 DeepSeek 官方于 20260813 开源的 Agent 运行时框架,MIT 许可证,用 TypeScript 开发。其核心理念是"一切皆插件"(everything is a plugin)——整个系统由一个可插拔的 profile 骨架和 60+ 官方能力包组成,模型无关,支持 Claude、GPT、…
仓库攻略
540 篇 · 535 个项目 · LLM 基础设施
bossagentcli 是一个面向 BOSS 直聘(以及智联、前程无忧占位)的本地命令行求职工具 + AI Agent 集成层。README 自述:"Localassist BOSS Zhipin CLI for AI agents — search, welfare filtering, shortlist, JSONenvelope output; l…
latexcv 是 Jan Küster 开发维护的 LaTeX 简历(CV)和履历表模板集合,目前在 GitHub 上被广泛使用。所有模板均为原创设计,非从模板网站复制,代码自行实现,结构清晰、注释完整。 项目特色: 用 Word 或在线工具做简历,格式不专业、排版难精确控制、跨平台表现不一致。LaTeX 简历模板解决了"内容与样式分离"的问题——你只管填…
PromptEngineeringGuideChinese(Prompt 工程师指南中文版)是由 wangxuqi 维护的中文翻译项目,翻译自 DAIR.AI 的英文原版 dairai/PromptEngineeringGuide(Stars 77.3k+)。原版是目前最全面、最活跃的 Prompt 工程开源教程,涵盖从基础概念到高级技巧的完整知识体系。 本…
CubeStudio(立方工作室)是一款国产化、云原生的开源一站式 AI 平台,MIT 协议,开源免费商用,已在数千家企业实现私有化部署。 它的定位是 MLOps / MaaS / 算力调度 / 训推平台 的全集,覆盖从数据管理、模型训练、到推理服务的完整链路。核心功能包括:多租户算力调度、拖拉拽 Pipeline 编排、分布式多机多卡训练、超参搜索、vLL…
MOPD(MultiDomain OnPolicy Distillation,多域同策略蒸馏) 是一种将多个领域专家模型的能力整合到单一模型中的后训练范式。它由小米 MiMo 团队提出(论文 arXiv:2606.30406),核心做法是:先在各自领域独立训练 RL specialist teacher(数学、代码、Agent 等),再通过同策略蒸馏将所有 …
MetaMCP 是一个 MCP(Model Context Protocol)代理基础设施,集 MCP 服务器聚合(Aggregator)、编排(Orchestrator)、中间件(Middleware)、网关(Gateway)于一个 Docker 容器。它的核心定位是:让你不必逐个管理多个 MCP 服务器,而是把它们聚合成一个统一端点,再对外暴露。 技术本…
2026 年 2 月,SWEbench 官方团队对主流大模型做了一次非自报告的独立评测(官方 leaderboard 批量运行),Simon Willison 对此做了详细分析笔记。 这次的核心数据是 Bash Only 赛道的榜单——所有模型在相同系统提示词下、用相同的 minisweagent(约 9,000 行 Python)跑 SWEbench Ve…
DecryptPrompt 是一个大模型提示词/Agent/RAG/LLM 全栈知识图谱,收录 Prompt 论文、开源模型、推理框架、SFT/RLHF 数据集、AIGC 应用案例等多个维度的资源。更重要的是,作者维护了一个持续更新的"解密Prompt"系列博客(65+ 篇),每篇包含论文串讲+代码实现,覆盖从 Prompt Tuning 到 RLHF、Ag…
封神榜(FengshenbangLM) 是 IDEA 研究院认知计算与自然语言研究中心(CCNL)主导的中文大模型开源体系,2021 年 11 月由沈向洋在 IDEA 大会上正式发布。定位是"中文认知智能的基础设施",旗下包含 6 大模型系列,覆盖从语言理解到多模态生成的完整 NLP 任务。 三个子项目协同工作: Fengshenbang Model:预训练…
Meta Muse Glimmer 是 Meta 超级智能实验室(Meta Superintelligence Lab)于 2026 年 8 月 开源发布的 ~29.6B 参数多模态推理模型,权重基于 Apache 2.0 许可证,完全开放商用。它是 Meta 自 Llama 时代之后首次重新发布开源权重,被 @rasbt 形容为「Llama 时代以来 Me…
Claude Code Skill Factory 是一个用自然语言交互构建生产级 Claude Skills、Claude Code Agents、自定义 Slash Commands 和 LLM Prompts 的开源工具包。 简单说:你要写一个 Claude Skill,不用从零憋文档,直接回答几个问题,Factory Agent 帮你生成完整的 SK…
ToolHive 是 Stacklok 开源的企业级 MCP(Model Context Protocol)服务器运行与管理平台,定位类似 MCP 界的"Kubernetes"——用容器隔离每一个 MCP 服务器,用声明式 API 集中管控注册表、网关、运行时和安全策略。 核心卖点三条: 1. 安全隔离:每个 MCP 服务器跑在独立容器里,凭证不泄露到本地,…
Humanize 是一个 Claude Code 插件,提供RLCR 双循环迭代开发模式——Claude 负责实现,OpenAI Codex 负责独立审查,人类始终是最终决策者。通过持续反馈循环,将 AI 生成代码的质量问题在迭代中早期捕获,而非等到最终 review。 核心哲学来自 Richard Sutton 的"Bitter Lesson":通用方法(…
pmclaudeskills 是一个 1098 个 Agent Skills 的开源库(README 自报,⚠️ 计数随版本变化请以 SKILLS.md 为准)。这里的 "PM" 含义是 Professional,不只是 Product Management。每个 Skill 是一个 SKILL.md(标准 Anthropic Claude Skills 格…
nvidia_gpu_exporter 是一个用 Go 编写的 Prometheus GPU 指标导出器,底层调用 nvidiasmi(NVIDIA 系统管理接口)采集显卡实时状态——包括 GPU 利用率、显存占用、温度、功率、风扇转速、时钟频率等——并以 Prometheus 标准格式(/metrics 端点)暴露出来,可直接对接 Grafana 渲染监控…
claudekitskills 是 mrgoonie 在 GitHub 上维护的一套 Claude Agent Skills 合集,托管于 ClaudeKit.cc(一个非 Anthropic 官方的 Claude 第三方服务平台)。这并非 Anthropic 官方产品,而是社区将高频使用场景封装为可复用的 Skill 工作流——每个 Skill 约等于一个…
genieincodebottle/generativeai 是一个 GenAI 全景学习资源库,自称「一站式 GenAI 学习中心」。内容覆盖完整学习路线图(Roadmap)、22 个学习 track、300+ 模块、9 个实战项目、面试准备(13 个模块)、简历优化,以及大量配套 PDF / Notebook 资源。配套运营一个独立平台 AIML Com…
sergebulaev/linkedinskills 是一套 11 个 Claude Code / Codex Skills,用于自动化 LinkedIn 内容创作与运营。覆盖发帖、评论、回复、审计、人性化改写、钩子提取、内容规划、个人档案优化等全链路场景。所有技能都是「先出草稿、等用户确认」模式——不会擅自发布任何内容。 底层还有配套的社交媒体 Skill…
MaplePreview 是 DeepGrove(@deepgrove_ai)于 2026 年 8 月初开源的一个 20BA1B 三元权重组合专家(ternaryweight MoE)推理模型。所谓"三元权重",即权重值仅使用 {1, 0, +1} 三个离散值,而非常见的 INT4/INT8 量化——这意味着权重本身已经是极端低精度状态,但仍从零开始以三元格…
NVIDIA/GenerativeAIExamples 是 NVIDIA 官方的生成式 AI 参考工作流仓库,针对加速基础设施(GPU/NIM 微服务)做了深度优化,涵盖 RAG 管道、Agentic 工作流、知识图谱、视觉 NIM 工作流、Data Flywheel 完整闭环等场景。当前最新 release 为 v0.8.x(2025 年),目录结构已完成…
borghei/ClaudeSkills 是一个超大型 AI 技能库,涵盖 368 个 Prompt 技能(Skills)、76 个专家级 Agent 身份(Agents)、859 个纯 Python 标准库工具,面向工程、产品、营销、合规、法务、财务等全团队场景。安装后可在 Claude Code、Cursor、Codex、Gemini CLI、Copil…
长程推理(longhorizon reasoning)要求模型在一个回答链内反复切换不同技能:比如先做数学推导,再用结果来规划日程。现有评测基准往往只考单个技能,无法衡量模型在技能之间灵活切换的能力。 SkillNative LLMs 是普林斯顿、CMU、MIT 等机构在 2026 年 8 月发表的论文(arXiv:2608.05139),从评测和训练两个方…
Agent Research Copilot (ARC) 是一套面向理论物理研究的 LLMAgent 工作流,由 Yanjiao Ma、Yi Wang、Xingkai Zhang 三人署名,已发布 ChinaXiv:202606.00234(v1,202606)。它本身不是单一 CLI,而是「7 个可独立复用的 Python 包 + 一层对 coding a…
humanizetext 是 lynoteai 维护的「AI 文本人类化」开源 Python 工具包。它本质上是把「让 AI 生成文本读起来更像人写的」这件事拆成两条路径: 4 套参考实现(v1.0 沉淀):翻译链、多轮 LLM 改写、检测器反馈循环、混合引擎翻译。 1 套标准流水线(v1.5.1 现行生产推荐版):把方法 1(翻译链)+ 方法 2(LLM …
ClaudePrism 是一个 本地优先的离线科学写作工作空间,由 Tauri 2(Rust)构建的原生桌面应用,集成 LaTeX 编译(嵌入式 Tectonic)、Python 科学计算环境(uv)、以及 100+ 领域专项 Claude Skills(来自 KDense Scientific Skills 项目)。简单说:它把 OpenAI Prism …
rampstackco/claudeskills 是一个 Claude Skills 技能库,包含 103 个互相组合的模块化技能,覆盖从品牌策略、设计系统、内容生产、SEO、产品管理、前端开发到增长运营的完整网站生命周期。每一个 Skill 都是一个独立文件夹,内含 SKILL.md(指令 + YAML 元数据)以及可选的参考文件(模板、清单、工作示例)。…
AgentENV(简称 AENV)是 Kimi K3 模型背后用于大规模运行 Agent 执行环境的分布式平台,由 kvcacheai 团队开源。它的核心职责是:在大规模集群上同时调度成千上万个轻量级隔离沙盒(基于 Firecracker microVM),按需加载 OCI 镜像,让每个 Agent 任务在独立、可快启、可快停的环境中运行。 类比来说:如果 …
jadxaimcp 是一套为 JADX(Android APK 反编译器)接入 Model Context Protocol(MCP)的插件 + 服务器组合。安装后,LLM(如 Claude)可以通过 MCP 协议实时读取 JADX 反编译出的 Java/Smali 代码,进行漏洞检测、代码理解、反混淆和逆向辅助——整个过程在 JADX GUI 内完成,无需…
Google Workspace MCP Server(workspacemcp)是目前功能最完整的 Google Workspace MCP 服务器,通过 MCP(Model Context Protocol)协议将 AI 助手连接到 Google 全套生产力工具——覆盖 Gmail、Drive、Calendar、Docs、Sheets、Slides、Fo…