Deepseek Harness EAC(EAC = Embracing All Creation,揽尽万象)是一个将官方 deepseekai/deepseekharness(@deepseekai/dsh)封装为开箱即用桌面客户端的项目,内置完整 Node.js 运行时 + dsh CLI,提供 Windows/Linux 安装版、便携版和 Tauri …
仓库攻略
34 篇 · 32 个项目 · 评测基准 · Agent 智能体
代表攻略
imsai-sh/awesome-deepseek-harness-plugins · 上手攻略
awesomedeepseekharnessplugins 是一个 DeepSeek Harness(DSH)插件精选目录与市场索引,自动收集 GitHub 上所有带 dshplugin / dshskill / dshbundle 等 topic 的公开仓库,对它们做 DSH 插件规范校验(格式校验 + 自动筛选),并通过 提供免费搜索 API 与排行数据…
同类项目 2展开比较
同名 Awesome 仓库已合并展示,原攻略与详情链接均保留。
imsai-sh/awesome-deepseek-harness-plugins
Stars 136
代表
Zhiyuan-Fan/Awesome-DeepSeek-Harness-Plugins
Stars 134
内容待复核
dshmarket 是 DeepSeek Harness(DSH)协议的可视化插件市场。简单说:你在 DeepSeek Harness 里装插件、换主题、管更新,以前要敲命令行、改配置文件,现在全部在浏览器界面里点一点搞定。 DSH 是一个本地 AI Agent 运行时(类似提前跑好的 agent loop),核心用 MIT 协议开源(deepseekai …
DeepSeek Harness Handbook 是一个独立维护的权威实战手册,面向在生产环境或日常工作中使用 DeepSeek Harness(DSH)的开发者、运维和 AI 爱好者。它不是命令列表,而是一部覆盖完整 Agent 边界的操作指南——从模型路由、工具调用、权限审批、沙盒隔离、持久化 Session、插件体系、MCP(Model Contex…
代表攻略
0xsline/awesome-deepseek-harness · 上手攻略
DeepSeek Harness(DSH)是 DeepSeek 官方推出的 AI Agent 运行时,而 0xsline/awesomedeepseekharness 是一个精选生态导航库——它汇总了来自官方 dshexternal/hub 目录和 GitHub dshplugin 公开话题的所有插件、工具与基础设施,按功能分成 20 个分类,方便使用者快速…
同类项目 2展开比较
同名 Awesome 仓库已合并展示,原攻略与详情链接均保留。
0xsline/awesome-deepseek-harness
Stars 778
代表
Dominic789654/awesome-deepseek-harness
Stars 133
DSH Desktop(DeepSeek Harness Desktop)是将 DeepSeek 官方 CLI 工具 dsh(DeepSeek Harness)封装为开箱即用桌面客户端的项目。打包内置完整 Node.js 运行时 + npm CLI + 全部官方插件,双击即启动 dsh web UI,无需用户自行安装任何环境。适合不想折腾命令行、直接在 Wi…
DiGbench(Discovery in Games)是 2026 年 8 月 12 日由 James C.R. Whittington(牛津大学)联合多位学者发布的新型 AI 评测基准,全称 Discovery in Games。 核心设计:70 个纯文本互动游戏,每个游戏内部有隐藏的「变换规则」,AI 智能体必须通过主动交互和实验来发现这些规则,然后将…
dshai4scholar 是 DeepSeek Harness(dsh)的官方学术文献插件,提供 38 个原生 Agent 工具,覆盖文献检索、全文获取、引用管理、科学图表生成等科研写作全流程。 它本质上是一个 Node.js 包(dsh 插件),安装后在 dsh web 界面中注册 38 个工具,并通过 ai4scholar.net 的 API 接入 S…
DSH Desktop(DeepSeek Harness Desktop)是 DeepSeek Harness(DSH)插件生态的原生桌面封装。把官方 Harness 的本地 Web UI、Host 服务和插件系统装进 Electron/Tauri 原生桌面应用,一键安装、自动管理服务、集成系统托盘,无需安装 Node.js 或手动敲命令。 核心理念:万物皆…
hairyf/deepseekharnessdesktop 是 DeepSeek Harness(DSH) 的 Tauri 桌面版封装,由 hairyf 个人维护。它将 DSH 这套「插件化 Agent 执行框架」的 Web UI 打包成无需 Node.js / pnpm / Docker 即可运行的本地桌面应用,安装包仅约 5 MB,首次启动自动下载 No…
DSH 插件市场(DSH Plugin Marketplace)是一个为 DeepSeek Harness(DSH) 打造的插件市场插件,通过在 DSH Web GUI 的设置页面中嵌入一个卡片列表界面,让用户无需命令行即可浏览、安装、更新 GitHub 上全部打有 dshplugin topic 的插件,以及 14000+ 通用 Skills(来自 age…
dshtianshutui(npm 包名 @huiliyi37/dshtianshutui)是 DeepSeek Harness(官方 CLI @deepseekai/dsh)的交互式终端极简风格 UI 插件。它以自研 ANSI 渲染为核心,在官方 Web UI 之外提供类 Claude Code 风格的纯终端对话界面,并叠加了 TDD 工作流、证据门、视觉…
dshwebui 是给 DeepSeek Harness(以下简称 DSH)Web GUI 的一站式插件与皮肤全家桶,通过官方 profile 机制挂载,不改 DSH 源码。所有插件以 npm 包发布(@linxin666/ scope),可逐个安装也可一次性装齐。 仓库包含 11 个子包,核心能力如下: | 能力 | 说明 | ||| | 梁神模式 | 面…
DSH Desktop 是 DeepSeek Harness 的跨平台桌面包装器(Electron),把本地运行的 DeepSeek Harness Web UI 封装为 macOS / Windows 原生桌面应用,让用户无需手动启动 CLI、无需管理本地端口,在桌面窗口中直接使用完整的 Harness Agent Runtime 体验。 本质上是一个 E…
ExtractBench 是由 LlamaIndex 团队发布的企业文档结构化提取基准评测(GitHub: runllama/ExtractBench,论文: arXiv:2607.29677,数据集: HuggingFace)。 它的评测任务是:给定一份企业文档(PDF/图片)和一个用户定义的 JSON Schema,提取出符合 Schema 的结构化数据…
awesomedshplugin 是 DeepSeek Harness(DSH)社区插件精选列表,目前收录 204 个插件,全部可通过 dsh plugin add 一键安装。 DeepSeek Harness(dsh)是 DeepSeek 开源的 Coding Agent 框架,同时提供 Web UI 和 headless 两种运行形态。它的核心设计哲学是…
2026 年 2 月,SWEbench 官方团队对主流大模型做了一次非自报告的独立评测(官方 leaderboard 批量运行),Simon Willison 对此做了详细分析笔记。 这次的核心数据是 Bash Only 赛道的榜单——所有模型在相同系统提示词下、用相同的 minisweagent(约 9,000 行 Python)跑 SWEbench Ve…
EvalScope 是魔搭社区(ModelScope)打造的一站式大模型评测框架,用一行命令即可对 LLM、VLM、Embedding、Reranker、AIGC 等多类型模型进行能力评估、推理性能压测和结果可视化。 核心场景:评测模型效果(能力基准)、压测推理性能(TTFT/TPOT 等指标)、Agent 轨迹回放、多模型对战(Arena)。 ⚠️ Eva…
ArcKit(Enterprise Architecture Governance Harness)是一套面向企业架构师和 AI 编程助手用户的开源工具包,将企业架构治理从散落的文档、Word、表格、邮件中抽离出来,变成系统性、AI 辅助的工作流。 它以 Claude Code 插件形式发布,提供 75 条官方命令,覆盖战略规划、利益相关者分析、风险评估(H…
PostTrainBench 是一个衡量 AI Agent 能否自主完成 LLM 后训练(posttraining)的评测基准,由 aisagroup(马克斯·普朗克研究所 & ELLIS)发布,arXiv:2603.08640。 其核心设计:给 AI Agent 一块 H100 GPU、10 小时、一个小基座模型,让它自主做完整的 posttraining…
smevals(全称 "small evals")是 Prime Radiant 实验室推出的开源 Python CLI 评测框架,主打轻量、可复制、以目录为评测单元的设计理念。MIT 许可证,由 Simon Willison 主导开发,定位是帮助开发者在小模型与高性价比方案中做出选择——而不必总是跑最贵的 frontier 模型。 核心理念来自官方博客原文…
Harness Anything 是一个开源的 AI Agent 控制中枢,通过 CLI 封装,将一系列闭源商业软件(WPS Office、Microsoft Office、Adobe 全家桶、Zotero)变成 AI Agent 可编程操控的目标。核心思路借鉴 CLIAnything 的 Harness 方法论,但后者只支持 GIMP、Blender 等开…
ParseBench 是 LlamaIndex 在 CVPR 2026 上发布的首个面向 AI Agent 的文档解析评测基准(arXiv:2604.08538,cs.CV)。 它的核心命题是:文档 OCR 不是"把 PDF 转成文字",而是必须保留足够的结构和语义,让 Agent 能可靠地自主决策。一旦表格列对齐错位、小数点丢失、删除线被静默丢弃,Agen…
Agenta 是一个开源的 LLMOps 平台,把 LLM 应用从原型到生产所需的四件事压在一个工作流里:Prompt Playground(交互式调试)、Prompt/Cofig 管理(带版本和分支)、LLM 评估(人评 + 自动评估 + LLMasjudge)、可观测性(Tracing、成本、延迟)。代码以 TypeScript 为主、许可 NOASSE…
这是 Anthropic 官方开源的参考实现(Reference Implementation),用于展示如何用 Claude 实现自动化漏洞发现和修复。仓库基于 Anthropic 与多家企业安全团队合作(代号 Glasswing 项目)的实战经验总结而成,提供了从威胁建模到漏洞扫描、分诊、补丁生成的完整流水线原型。 ⚠️ 重要说明:仓库 README 明…
Helicone 是一个开源的 LLM 可观测性(Observability)与 AI 网关(AI Gateway)平台,定位是帮助 AI 工程师一站式完成模型调用监控、成本分析、流量路由、Prompt 版本管理和微调数据准备。它诞生于 Y Combinator W23 批次,GitHub Stars 已超过 5,900(数据截至 202607),是 LLM…
aijobsearch 是一个本地运行的 AI 求职框架,以 Claude Code 为核心引擎,把求职的全套流程自动化:搜索职位 → 评估匹配度 → 定制 CV → 写求职信 → 面试准备,全部在你自己机器上跑,数据不经过任何第三方服务器。 核心思路是"drafterreviewer"双 Agent 流水线:drafter 生成内容,reviewer 批判…
Phoenix 是 Arize 开源的可观测性平台,专为 LLM 应用设计,提供追踪(Tracing)、评估(Evaluation)、数据集管理和实验对比四大核心能力。 在 LLM 应用开发中,最大的痛点之一是「看不见内部」——你不知道 RAG 检索到了什么文档、Token 消耗了多少、哪次调用拖慢了整体响应。Phoenix 用 OpenTelemetry …
MemPalace 是一个本地优先的 AI 记忆系统,核心卖点是:原文逐字存储(不摘要、不压缩)、可插拔向量后端、96.6% R@5(LongMemEval 基准)以及完全零 API 调用。数据永远留存在本机,通过语义搜索而非总结来召回历史上下文。 它的组织模型借用了"记忆宫殿"的隐喻: 官方文档: | PyPI:mempalace ⚠️ 防骗警告:MemP…
⚠️ 重要注意:该仓库已于 2026 年 6 月 12 日被官方归档(readonly)。本文档如实记录其功能与用法;后续是否由社区 fork 延续请关注 GitHub。已生产使用的项目请评估替代方案(如 Langfuse、vLLM Gateway 等)。 TensorZero 是一个开源 LLMOps 平台,用 Rust 编写,以单一 Docker 容器交…