h3.c 是 MiniMax H3 视频/音频生成模型的原生 Metal 推理引擎,专为 Apple Silicon 设计。由 antirez(Redis 作者)手写 C + Metal 实现,不依赖 Python 或 PyTorch,直接跑在 Mac 的 GPU 上。 H3 是 MiniMax 开源的多模态生成模型,支持文生视频、文生音频、首帧/尾帧条件化…
仓库攻略
540 篇 · 535 个项目 · LLM 基础设施
SynaLinks/synalinksskills 是一套面向 AI 编程 Agent 的 SKILL.md 技能包,专门教 Claude Code、Codex、OpenCode、pi 等主流 coding agent 如何写出符合 SynaLinks 框架规范的代码。技能本身是一个标准化的 SKILL.md 文件,基于 Anthropic 主导的 Agen…
Taskuary 是一个本地优先的 AI 任务中枢,把邮件(Outlook)、协作平台(Teams、Slack)以及 GitHub Issues 的消息汇聚到同一个时间线,由 AI 做预分类(triage),识别出哪些是真正需要处理的工作,再把任务分发给你已有的 Coding CLI(Claude Code、Codex、Gemini、Cursor、Copil…
MindPipe 是一个统一的 LLM/VLM 模型压缩评估框架,用单一 main.py CLI 驱动 11 种量化方法、7 种剪枝方法、压缩微调联合流程,以及 PPL / lmevalharness 零样本 / VLMEvalKit 多模态三类评估。核心设计理念是:一次配置,全流程可复现。 ⚠️ 注意:本仓库同时支持 NVIDIA GPU 和华为昇腾 NP…
WISP(Workspace for Intelligent Scientific Practice)是一个开源、本地优先的桌面 AI 科研工作台,将文献检索、Python/R 执行、~80 个科学数据库查询、AI 模型调用集成在一个项目中,支持 SSH/WSL/本地 GPU 多种计算后端,数据和凭证保留在本地不传云端。 AI 辅助科研工具普遍存在两个问题:…
TUUI(Tool Unitary Utility Integration)是一个基于 Model Context Protocol(MCP)的桌面端 AI 客户端,核心定位是跨供应商 LLM API 编排 + MCP 工具集成一体化桌面工具。使用 Electron + Vue 3 + Vuetify 构建,支持 Windows/macOS/Linux。TU…
LFM2.5 QAD(QuantizationAware Distillation)是 Liquid AI 发布的一种训练时量化蒸馏技术,原理是让一个高精度 teacher 模型直接蒸馏到一个量化后的 student 模型,而非先训练好再事后量化(PTQ,PostTraining Quantization)。 4 个 LFM2.5 尺寸均发布 QAD Q4_…
AwesomeLLMsforVulnerabilityDetection 是一个社区维护的精选论文 / 项目 / Agent Skill 索引,专注于"用大语言模型做软件漏洞检测"这个交叉方向。仓库由 huhusmang 维护,README 主表只展示 2025 年及之后的论文,2024 年及之前的单独归档在 docs/papers_archive.md,分…
llmpaperdaily 是一个每日自动化的 LLM / Agent 论文日报仓库,由作者 xianshang33 维护。它通过仓库内置的 GitHub Actions workflow(/.github/workflows/)从 arXiv 抓取与 LLM、Agent 相关的最新论文,做中文摘要后写入两个镜像目录: summary/:中文版论文摘要(Ma…
douyinmcpserver 是一个开源的抖音/字节系短视频数据提取工具,提供无水印视频下载链接获取、AI 语音识别提取视频文案两项核心功能。它同时提供 WebUI(浏览器界面)、MCP Server(AI 助手集成)、命令行三种使用方式,支持 Claude Desktop、 Cherry Studio 等支持 MCP 协议的应用。 核心语音识别使用硅基流…
RTPLLM(RealTime PrefillDecode LLM)是阿里巴巴大模型推理团队开发的高性能 LLM 推理加速引擎,脱胎于 FasterTransformer,在其基础上融合了 TensorRTLLM 的部分 CUDA kernel 实现,并参考了 vLLM 的 PagedAttention 等设计。该项目已在阿里内部广泛落地,支持淘宝问问、淘宝…
Qwen3.827B 是阿里巴巴 Qwen 团队发布的 Apache 2.0 开源多模态大模型(27B 参数,视觉+推理能力,原生上下文 256K,可扩展至 1M),Hugging Face GGUF 量化版本约 17GB(Q4_K_M),适合在中高端笔记本或迷你主机本地运行。 该模型的 reasoning_effort 参数控制隐藏推理 token 的用量…
BrowserWing 是一个浏览器自动化平台,将浏览器操作转化为 MCP 命令或 Claude Skill,让 AI Agent 通过结构化命令直接控制浏览器,而非依赖慢速、高 token 消耗的 LLM 视觉理解页面。 78 个内置脚本,覆盖 10 大分类:技术、社交、资讯、财经、娱乐、购物、求职、阅读、学术、搜索。数据以 JSON/CSV 结构化输出,…
Dust(dust.tt)是一个企业级 AI Agent 平台,帮助组织创建、部署和管理多用途 AI Agent,无需编写代码。其定位与 LangChain Agents / AutoGen 不同——Dust 强调的是「开箱即用的企业级可靠性」而非「开发者友好的代码框架」。 核心架构 primitives(Dust 2025 Blog 自述): 1. Tea…
MetaScreener 是一款开源的 AI 驱动系统评价(systematic review)筛选工具。它利用多个开源大语言模型组成并行投票 ensemble,对文献标题和摘要进行批量筛选,决定"纳入"或"排除",并附带置信度评分和不确定性量化。核心设计理念是:不用单一模型做决策,而是让 4+ 个模型同时审阅,通过置信度校准和分层决策路由,用机器替代人工完…
phodal/aigc 是一本关于大语言模型在真实世界应用的开源电子书(英文名:Unlocking the Potential of LLM: RealWorld Use Cases),由 Thoughtworks 架构师 phodal(李洁)主导,联合社内同事与开源社区于 2023 年上半年完成。内容覆盖 Prompt 编写模式、上下文工程、LLM 应用架…
open·kritt 是一款自托管、开源的多 Agent 漏洞研究编排工具。它不是单点扫描器,而是一个把"提示词工作流 + Agent 执行 + 结果验证 + 报告导出"串成可复用剧本(playbook)的控制台,主要面向安全研究员与对安全敏感的开发者。 定位上,它不尝试把整个仓库直接扔给一个大模型让它"找出漏洞"——README 原话是「Pointing …
minimalembodiment 是一个让大语言模型真正"拥有身体"的参考实现。它构建了一套最小化的硬件软件架构:LLM 通过 ESP32 微控制器感知物理世界(环境光、运动、声音、触觉压力、皮肤温度等),并通过三个输出通道(触觉、OLED 表情、压电蜂鸣器)做出反应。关键创新在于其中两个输出通道耦合回输入通道——模型能"听到自己说话"(声音输出→声音输入…
Aria(AI Research Assistant,ARIA = "AI Research Assistant" 倒写)是 Zotero 的一个本地插件,用 GPT4 系列模型为你的文献库添加对话式 AI 助手功能。装好后 Zotero 工具栏出现一个按钮,点开就能和当前选中的文献"对话"——问它摘要、方法论、找相关研究、写笔记。 最新版本: Zotero…
dshmarket 是 DeepSeek Harness(DSH)协议的可视化插件市场。简单说:你在 DeepSeek Harness 里装插件、换主题、管更新,以前要敲命令行、改配置文件,现在全部在浏览器界面里点一点搞定。 DSH 是一个本地 AI Agent 运行时(类似提前跑好的 agent loop),核心用 MIT 协议开源(deepseekai …
RAGSurvey 是一个按体系分类的 RAG 论文Awesome 列表,对应论文 RetrievalAugmented Generation for AIGenerated Content: A Survey(arXiv:2402.19473,2024 年 2 月,北大/北大深圳研究生院团队)。仓库按该论文提出的三层分类法,对 RAG 领域论文进行结构化整…
StarLive 是一个可完全自部署的直播互动平台(StarLive 星播),重构自旧版 LDLive(Netlify Serverless 无状态函数方案),升级为「独立 NestJS 后端 + Socket.IO 实时长连接」架构。核心功能包括:直播推流(RTMP 入 / HLS 出)、实时弹幕/礼物/红包/抽奖等互动玩法,以及内置星币(StarCoin…
beta9 是 Beam 公司的开源 serverless GPU 运行时引擎,为 AI 工作负载提供极速冷启动(<1 秒)的容器化部署能力。它支持 GPU 推理、沙箱隔离执行和后台任务队列,底层通过自定义容器运行时(非标准 Docker)和分布式缓存实现亚秒级冷启动。 Beam 官方提供托管云服务(beam.cloud),同时 beta9 完全开源,支持自…
mcphub.nvim 是 Neovim 的 MCP(Model Context Protocol)客户端插件,将 MCP 服务器集成到 Neovim 编辑工作流中。它通过统一配置管理所有 MCP 服务器,提供图形化界面进行服务器启停、工具测试和资源浏览,并与主流 Neovim AI 聊天插件(Avante.nvim、CodeCompanion.nvim、C…
mcdowellcv 是一个基于 Gayle L. McDowell(Career Cup 创始人)简历设计理念的 LuaLaTeX 类文件(mcdowellcv.cls),用于生成简洁、节省空间且视觉效果专业的简历(CV)。 它的设计特点是以紧凑的布局在有限篇幅内最大化信息密度,视觉上采用粗体小写字母(small caps)作为章节标题,配合横向分隔线,属…
WFGY(万法归一 / WanFaGuiYi)是一个面向 AI 推理、RAG 与 Agent 工作流的开源协议与工具生态系统。它的核心主张是:在嵌入空间(embedding space)中构建语义场定律(semantic field laws),让 LLM 能够自我收敛推理路径,减少 RAG 漂移、幻觉和"幽灵匹配"问题。 当前公开的最新版本为 WFGY 5…
DeepSeek Harness Handbook 是一个独立维护的权威实战手册,面向在生产环境或日常工作中使用 DeepSeek Harness(DSH)的开发者、运维和 AI 爱好者。它不是命令列表,而是一部覆盖完整 Agent 边界的操作指南——从模型路由、工具调用、权限审批、沙盒隔离、持久化 Session、插件体系、MCP(Model Contex…
MisakaNet 是一个面向 AI 编程 Agent 的"失败记忆"知识库。它本身不是 Agent 框架、不是向量数据库、不是云服务,它的定位非常窄:让 Agent 在跑代码撞墙时,能搜到一条"别人已经踩过、且给出可复制修复路径"的经验。 仓库以纯 Git + Markdown + Python 标准库的形式存在(misakanetcore 是独立 PyP…
Krasis 是一个混合 LLM 推理运行时,专注于在消费级显存受限的 NVIDIA GPU 上高效运行数百亿参数级别的 MoE(Mixture of Experts)大模型。它的核心设计目标是:让一张或两张普通游戏显卡(如 RTX 5090 32 GB、RTX PRO 6000 96 GB)就能跑得动原本需要 H100/A100 才能加载的千亿参数模型。 …
代表攻略
0xsline/awesome-deepseek-harness · 上手攻略
DeepSeek Harness(DSH)是 DeepSeek 官方推出的 AI Agent 运行时,而 0xsline/awesomedeepseekharness 是一个精选生态导航库——它汇总了来自官方 dshexternal/hub 目录和 GitHub dshplugin 公开话题的所有插件、工具与基础设施,按功能分成 20 个分类,方便使用者快速…
同类项目 2展开比较
同名 Awesome 仓库已合并展示,原攻略与详情链接均保留。
0xsline/awesome-deepseek-harness
Stars 778
代表
Dominic789654/awesome-deepseek-harness
Stars 133