Guides · organized/guides

仓库攻略

34 篇 · 32 个项目 · 评测基准 · Agent 智能体

zouyuxuan122/Deepseek-Harness-EAC · 上手攻略
Deepseek Harness EAC(EAC = Embracing All Creation,揽尽万象)是一个将官方 deepseekai/deepseekharness(@deepseekai/dsh)封装为开箱即用桌面客户端的项目,内置完整 Node.js 运行时 + dsh CLI,提供 Windows/Linux 安装版、便携版和 Tauri …
评测基准 zouyuxuan122/Deepseek-Harness-EAC Stars 875 Jay 2026-08-25
代表攻略
imsai-sh/awesome-deepseek-harness-plugins · 上手攻略
awesomedeepseekharnessplugins 是一个 DeepSeek Harness(DSH)插件精选目录与市场索引,自动收集 GitHub 上所有带 dshplugin / dshskill / dshbundle 等 topic 的公开仓库,对它们做 DSH 插件规范校验(格式校验 + 自动筛选),并通过 提供免费搜索 API 与排行数据…
评测基准 imsai-sh/awesome-deepseek-harness-plugins Stars 136 Tom 2026-08-21
同类项目 2展开比较

同名 Awesome 仓库已合并展示,原攻略与详情链接均保留。

dsh-market/dsh-market · 上手攻略
dshmarket 是 DeepSeek Harness(DSH)协议的可视化插件市场。简单说:你在 DeepSeek Harness 里装插件、换主题、管更新,以前要敲命令行、改配置文件,现在全部在浏览器界面里点一点搞定。 DSH 是一个本地 AI Agent 运行时(类似提前跑好的 agent loop),核心用 MIT 协议开源(deepseekai …
评测基准 dsh-market/dsh-market Stars 1,497 Tom 2026-08-21
sandbaseai/deepseek-harness-handbook · 上手攻略
DeepSeek Harness Handbook 是一个独立维护的权威实战手册,面向在生产环境或日常工作中使用 DeepSeek Harness(DSH)的开发者、运维和 AI 爱好者。它不是命令列表,而是一部覆盖完整 Agent 边界的操作指南——从模型路由、工具调用、权限审批、沙盒隔离、持久化 Session、插件体系、MCP(Model Contex…
评测基准 sandbaseai/deepseek-harness-handbook Stars 29 Tom 2026-08-21
代表攻略
0xsline/awesome-deepseek-harness · 上手攻略
DeepSeek Harness(DSH)是 DeepSeek 官方推出的 AI Agent 运行时,而 0xsline/awesomedeepseekharness 是一个精选生态导航库——它汇总了来自官方 dshexternal/hub 目录和 GitHub dshplugin 公开话题的所有插件、工具与基础设施,按功能分成 20 个分类,方便使用者快速…
评测基准 0xsline/awesome-deepseek-harness Stars 778 Jay 2026-08-20
同类项目 2展开比较

同名 Awesome 仓库已合并展示,原攻略与详情链接均保留。

myYangyunfan/dsh_desktop · 上手攻略
DSH Desktop(DeepSeek Harness Desktop)是将 DeepSeek 官方 CLI 工具 dsh(DeepSeek Harness)封装为开箱即用桌面客户端的项目。打包内置完整 Node.js 运行时 + npm CLI + 全部官方插件,双击即启动 dsh web UI,无需用户自行安装任何环境。适合不想折腾命令行、直接在 Wi…
评测基准 myYangyunfan/dsh_desktop Stars 463 Tom 2026-08-19
DiG-bench:纯文本科学发现能力评测基准 · 干货攻略
DiGbench(Discovery in Games)是 2026 年 8 月 12 日由 James C.R. Whittington(牛津大学)联合多位学者发布的新型 AI 评测基准,全称 Discovery in Games。 核心设计:70 个纯文本互动游戏,每个游戏内部有隐藏的「变换规则」,AI 智能体必须通过主动交互和实验来发现这些规则,然后将…
评测基准 discos-research/dig-bench Jay 2026-08-19
literaf/dsh-ai4scholar · 上手攻略
dshai4scholar 是 DeepSeek Harness(dsh)的官方学术文献插件,提供 38 个原生 Agent 工具,覆盖文献检索、全文获取、引用管理、科学图表生成等科研写作全流程。 它本质上是一个 Node.js 包(dsh 插件),安装后在 dsh web 界面中注册 38 个工具,并通过 ai4scholar.net 的 API 接入 S…
评测基准 literaf/dsh-ai4scholar Stars 10 Tom 2026-08-18
anywhere-labs/deepseek-harness-desktop · 上手攻略
DSH Desktop(DeepSeek Harness Desktop)是 DeepSeek Harness(DSH)插件生态的原生桌面封装。把官方 Harness 的本地 Web UI、Host 服务和插件系统装进 Electron/Tauri 原生桌面应用,一键安装、自动管理服务、集成系统托盘,无需安装 Node.js 或手动敲命令。 核心理念:万物皆…
评测基准 anywhere-labs/deepseek-harness-desktop Stars 13,495 Tom 2026-08-17
hairyf/deepseek-harness-desktop · 上手攻略
hairyf/deepseekharnessdesktop 是 DeepSeek Harness(DSH) 的 Tauri 桌面版封装,由 hairyf 个人维护。它将 DSH 这套「插件化 Agent 执行框架」的 Web UI 打包成无需 Node.js / pnpm / Docker 即可运行的本地桌面应用,安装包仅约 5 MB,首次启动自动下载 No…
评测基准 hairyf/deepseek-harness-desktop Stars 554 Jay 2026-08-17
bradeGithub/DSH-Plugins-Marketplace · 上手攻略
DSH 插件市场(DSH Plugin Marketplace)是一个为 DeepSeek Harness(DSH) 打造的插件市场插件,通过在 DSH Web GUI 的设置页面中嵌入一个卡片列表界面,让用户无需命令行即可浏览、安装、更新 GitHub 上全部打有 dshplugin topic 的插件,以及 14000+ 通用 Skills(来自 age…
评测基准 bradeGithub/DSH-Plugins-Marketplace Stars 123 Tom 2026-08-16
huiliyi37/dsh-tianshu-tui · 上手攻略
dshtianshutui(npm 包名 @huiliyi37/dshtianshutui)是 DeepSeek Harness(官方 CLI @deepseekai/dsh)的交互式终端极简风格 UI 插件。它以自研 ANSI 渲染为核心,在官方 Web UI 之外提供类 Claude Code 风格的纯终端对话界面,并叠加了 TDD 工作流、证据门、视觉…
评测基准 huiliyi37/dsh-tianshu-tui Stars 165 Tom 2026-08-16
zhu1090093659/dsh-web-ui · 上手攻略
dshwebui 是给 DeepSeek Harness(以下简称 DSH)Web GUI 的一站式插件与皮肤全家桶,通过官方 profile 机制挂载,不改 DSH 源码。所有插件以 npm 包发布(@linxin666/ scope),可逐个安装也可一次性装齐。 仓库包含 11 个子包,核心能力如下: | 能力 | 说明 | ||| | 梁神模式 | 面…
评测基准 zhu1090093659/dsh-web-ui Stars 4,541 Tom 2026-08-16
dataelement/dsh-desktop · 上手攻略
DSH Desktop 是 DeepSeek Harness 的跨平台桌面包装器(Electron),把本地运行的 DeepSeek Harness Web UI 封装为 macOS / Windows 原生桌面应用,让用户无需手动启动 CLI、无需管理本地端口,在桌面窗口中直接使用完整的 Harness Agent Runtime 体验。 本质上是一个 E…
评测基准 dataelement/dsh-desktop Stars 196 Jay 2026-08-15
ExtractBench:企业文档结构化提取基准评测 · 干货攻略
ExtractBench 是由 LlamaIndex 团队发布的企业文档结构化提取基准评测(GitHub: runllama/ExtractBench,论文: arXiv:2607.29677,数据集: HuggingFace)。 它的评测任务是:给定一份企业文档(PDF/图片)和一个用户定义的 JSON Schema,提取出符合 Schema 的结构化数据…
评测基准 run-llama/ExtractBench Jay 2026-08-15
awesome-dsh-plugin/awesome-dsh-plugin · 上手攻略
awesomedshplugin 是 DeepSeek Harness(DSH)社区插件精选列表,目前收录 204 个插件,全部可通过 dsh plugin add 一键安装。 DeepSeek Harness(dsh)是 DeepSeek 开源的 Coding Agent 框架,同时提供 Web UI 和 headless 两种运行形态。它的核心设计哲学是…
评测基准 awesome-dsh-plugin/awesome-dsh-plugin Stars 10,201 Tom 2026-08-14
modelscope/evalscope · 上手攻略
EvalScope 是魔搭社区(ModelScope)打造的一站式大模型评测框架,用一行命令即可对 LLM、VLM、Embedding、Reranker、AIGC 等多类型模型进行能力评估、推理性能压测和结果可视化。 核心场景:评测模型效果(能力基准)、压测推理性能(TTFT/TPOT 等指标)、Agent 轨迹回放、多模型对战(Arena)。 ⚠️ Eva…
评测基准 modelscope/evalscope Stars 3,218 Jay 2026-08-11
tractorjuice/arc-kit · 上手攻略
ArcKit(Enterprise Architecture Governance Harness)是一套面向企业架构师和 AI 编程助手用户的开源工具包,将企业架构治理从散落的文档、Word、表格、邮件中抽离出来,变成系统性、AI 辅助的工作流。 它以 Claude Code 插件形式发布,提供 75 条官方命令,覆盖战略规划、利益相关者分析、风险评估(H…
评测基准 tractorjuice/arc-kit Stars 2,133 Tom 2026-08-09
smevals 轻量评测框架:目录即评测 · 干货攻略
smevals(全称 "small evals")是 Prime Radiant 实验室推出的开源 Python CLI 评测框架,主打轻量、可复制、以目录为评测单元的设计理念。MIT 许可证,由 Simon Willison 主导开发,定位是帮助开发者在小模型与高性价比方案中做出选择——而不必总是跑最贵的 frontier 模型。 核心理念来自官方博客原文…
评测基准 prime-radiant-inc/smevals Jay 2026-08-02
yb2460/harness-anything · 上手攻略
Harness Anything 是一个开源的 AI Agent 控制中枢,通过 CLI 封装,将一系列闭源商业软件(WPS Office、Microsoft Office、Adobe 全家桶、Zotero)变成 AI Agent 可编程操控的目标。核心思路借鉴 CLIAnything 的 Harness 方法论,但后者只支持 GIMP、Blender 等开…
评测基准 yb2460/harness-anything Stars 1,419 Tom 2026-07-28
ParseBench 文档解析评测基准 · 干货攻略
ParseBench 是 LlamaIndex 在 CVPR 2026 上发布的首个面向 AI Agent 的文档解析评测基准(arXiv:2604.08538,cs.CV)。 它的核心命题是:文档 OCR 不是"把 PDF 转成文字",而是必须保留足够的结构和语义,让 Agent 能可靠地自主决策。一旦表格列对齐错位、小数点丢失、删除线被静默丢弃,Agen…
评测基准 run-llama/ParseBench Jay 2026-07-22
Agenta-AI/agenta · 上手攻略
Agenta 是一个开源的 LLMOps 平台,把 LLM 应用从原型到生产所需的四件事压在一个工作流里:Prompt Playground(交互式调试)、Prompt/Cofig 管理(带版本和分支)、LLM 评估(人评 + 自动评估 + LLMasjudge)、可观测性(Tracing、成本、延迟)。代码以 TypeScript 为主、许可 NOASSE…
评测基准 Agenta-AI/agenta Stars 4,303 spark 2026-07-17
anthropics/defending-code-reference-harness · 上手攻略
这是 Anthropic 官方开源的参考实现(Reference Implementation),用于展示如何用 Claude 实现自动化漏洞发现和修复。仓库基于 Anthropic 与多家企业安全团队合作(代号 Glasswing 项目)的实战经验总结而成,提供了从威胁建模到漏洞扫描、分诊、补丁生成的完整流水线原型。 ⚠️ 重要说明:仓库 README 明…
评测基准 anthropics/defending-code-reference-harness Stars 6,618 Tom 2026-07-13
Helicone/helicone · 上手攻略
Helicone 是一个开源的 LLM 可观测性(Observability)与 AI 网关(AI Gateway)平台,定位是帮助 AI 工程师一站式完成模型调用监控、成本分析、流量路由、Prompt 版本管理和微调数据准备。它诞生于 Y Combinator W23 批次,GitHub Stars 已超过 5,900(数据截至 202607),是 LLM…
评测基准 Helicone/helicone Stars 6,051 Tom 2026-07-12
MadsLorentzen/ai-job-search · 上手攻略
aijobsearch 是一个本地运行的 AI 求职框架,以 Claude Code 为核心引擎,把求职的全套流程自动化:搜索职位 → 评估匹配度 → 定制 CV → 写求职信 → 面试准备,全部在你自己机器上跑,数据不经过任何第三方服务器。 核心思路是"drafterreviewer"双 Agent 流水线:drafter 生成内容,reviewer 批判…
评测基准 MadsLorentzen/ai-job-search Stars 31,142 Jay 2026-07-12
Arize-ai/phoenix · 上手攻略
Phoenix 是 Arize 开源的可观测性平台,专为 LLM 应用设计,提供追踪(Tracing)、评估(Evaluation)、数据集管理和实验对比四大核心能力。 在 LLM 应用开发中,最大的痛点之一是「看不见内部」——你不知道 RAG 检索到了什么文档、Token 消耗了多少、哪次调用拖慢了整体响应。Phoenix 用 OpenTelemetry …
评测基准 Arize-ai/phoenix Stars 10,982 Tom 2026-07-11
MemPalace/mempalace · 上手攻略
MemPalace 是一个本地优先的 AI 记忆系统,核心卖点是:原文逐字存储(不摘要、不压缩)、可插拔向量后端、96.6% R@5(LongMemEval 基准)以及完全零 API 调用。数据永远留存在本机,通过语义搜索而非总结来召回历史上下文。 它的组织模型借用了"记忆宫殿"的隐喻: 官方文档: | PyPI:mempalace ⚠️ 防骗警告:MemP…
评测基准 MemPalace/mempalace Stars 58,289 Jay 2026-07-10
tensorzero/tensorzero · 上手攻略
⚠️ 重要注意:该仓库已于 2026 年 6 月 12 日被官方归档(readonly)。本文档如实记录其功能与用法;后续是否由社区 fork 延续请关注 GitHub。已生产使用的项目请评估替代方案(如 Langfuse、vLLM Gateway 等)。 TensorZero 是一个开源 LLMOps 平台,用 Rust 编写,以单一 Docker 容器交…
评测基准 tensorzero/tensorzero Stars 11,724 Jay 2026-07-09