研究库 实战攻略
Guides · organized/guides

仓库攻略

74 篇 · 74 个项目 · jay · 安全与风险

Jev-as-a-Judge:把评分跑进每一个生产 Trace · 干货攻略
Jev 是 TypeSafe AI(2026 年 9 月中旬发布)的首个 "System One" 模型——它不是语言模型,不生成任何文本,只做一件事:输入一段结构化 state,加上类型化的问题,得到带概率的决策答案。 这个定位恰好精确命中了 Agent 评测的核心形状:给定 agent 的 trace 和状态,判断这次行为是否合规、是否安全、评分几分。 …
Jay 2026-10-09
amitshekhariitbhu/ai-engineering-course · 上手攻略
AI Engineering Course 是由 Amit Shekhar(Outcome School 创始人)维护的免费、完整、自包含的 AI 工程学习路径。目前 18 个模块、146+ 节课,每节课都是一篇图文并茂的博客,部分附视频。从机器学习基础讲到 LLM 微调、RAG、AI Agent、推理工程、AI Safety 和系统设计,适合想从零建立完整…
Agent 智能体 amitshekhariitbhu/ai-engineering-course Stars 500 Jay 2026-10-05
Zhou-Yujing114514/deepseek-harness-linux · 上手攻略
这是一个社区维护的下游 fork,专注于为 DeepSeek Harness(DeepSeek 官方桌面端)提供一等公民级的 Linux 打包支持。 官方 DeepSeek Harness 桌面端目前只发布 macOS 和 Windows 安装包,Linux 用户要么退而求其次用 Web 版,要么自己从源码编译。本项目填补了这个缺口:以 AppImage /…
评测基准 Zhou-Yujing114514/deepseek-harness-linux Stars 59 Jay 2026-10-04
angusdevgo/Seep-Reverse-Lab · 上手攻略
SeepReverseLab(简称 Seep)是一个面向 AI Agent 的多平台客户端逆向工程自动化工作台,同时也是一套 CWE602(客户端授权脆弱性)专项审计框架。它将 Radare2、JADX、Apktool、Frida、IDA Pro 等分散的逆向工具链,封装为统一的 MCP(Model Context Protocol)工具矩阵,让 AI Ag…
Agent 智能体 angusdevgo/Seep-Reverse-Lab Stars 577 Jay 2026-09-30
yyjeqhc/webcodex · 上手攻略
WebCodex 是一个本地开发环境桥接工具,让云端 AI Agent(如 ChatGPT、Claude)直接使用你本机已有的真实代码仓库、Git 工作区和开发工具链,而不需要把代码上传到任何托管服务或云端沙箱。 核心定位是把「AI 客户端(MCP)」和「你的真实机器」连接起来:AI 负责理解、修改、审查代码,运行测试和命令;代码、编译器、Git 历史都在你…
Agent 智能体 yyjeqhc/webcodex Stars 2,032 Jay 2026-09-29
加密推理链可被跨 API 漏洞窃取 · 干货攻略
一篇 2026 年 8 月 10 日提交的学术论文(arXiv:2608.09867,cs.CR),由来自 MATS Research、ELLIS Institute Tübingen、Max Planck Institute for Intelligent Systems、Snyk 的研究人员撰写。论文发现:Anthropic、OpenAI、Google …
无 Jay 2026-09-26
加密推理链可被跨 API 漏洞窃取 · 干货攻略
2026 年 8 月 10 日,一支来自 ELLIS Institute Tübingen、Max Planck Institute for Intelligent Systems、MATS Research 的研究团队(含 Alexander Panfilov、David Schmotz、Ilia Shumailov 等人)在 arXiv 发布论文 "St…
Jay 2026-09-26
EvotecIT/OfficeIMO · 上手攻略
OfficeIMO 是一个完全脱离 COM 和 Microsoft Office 的 .NET 文档处理库全家桶,用 Open XML SDK 底层实现,覆盖 Word(.docx / .doc)、Excel(.xlsx / .xls)、PowerPoint(.pptx / .ppt)、PDF、OneNote、Visio、Markdown、HTML、RTF、…
工程化 EvotecIT/OfficeIMO Stars 565 Jay 2026-09-22
choxos/jev-reviewer · 上手攻略
Jev Reviewer(访问入口还有 Review)数据提取工具。研究者打开一篇论文的 PDF、补充材料、试验方案或数据表格,直接提问——例如"入组年龄范围是多少""谁资助了这项研究""随机化人数几人"——工具从文档中返回逐字引用(verbatim quote),标注来自哪个文件的哪一页、哪一段或哪一行,并在原文件中高亮显示该位置。无需安装、无需 API …
评测基准 choxos/jev-reviewer Stars 19 Jay 2026-09-20
commit-rewriter · 干货攻略
commitrewriter 是 Simon Willison(@simonw)9 月 14 日发布的本地 Web 应用,用于批量编辑 Git 仓库的提交信息。核心使用场景是:Coding Agent 生成的提交记录往往带有大量"机器腔"——冗长的内部 ID 引用、不适合公开的 issue 编号、重复的 agent 生成 boilerplate。Simon …
simonw/commit-rewriter Jay 2026-09-15
GPT-6 Astra + Codex + Blender:让 AI 亲手渲染一只骑自行车的鹈鹕 · 干货攻略
一个由 GPT6 Astra(Medium)+ OpenAI Codex 模式驱动的 AI 编码智能体,在 macOS 上自动调用本地已安装的 Blender 桌面应用,通过 Blender Python API 生成可编辑的 .blend 三维场景文件,并渲染出成品图像。 整个过程完全由自然语言驱动——用户只给了三句提示词,AI 自己: 1. 写 Pyth…
simonw/gpt-6-astra-blender-pelican-bicycle Jay 2026-09-14
Armur-Ai/Pentest-Swarm-AI · 上手攻略
Pentest Swarm AI 是一个基于真实群智(Swarm)架构的开源渗透测试引擎,由 Go 语言编写,支持 Claude、GLM、Qwen、DeepSeek、Gemini、Ollama 等任意具备 functioncalling 能力的 LLM。与传统多 Agent 工具「单 Planner 按固定顺序调用各阶段」不同,Pentest Swarm A…
Agent 智能体 Armur-Ai/Pentest-Swarm-AI Stars 2,492 Jay 2026-09-13
Miles v0.1 · 干货攻略
Miles 是 RadixArk 开源的企业级大模型 RL 后训练框架(v0.1 发布于 2026 年 8 月 18 日),定位与 OpenAI 的训练+推理协同思路类似,但完全开源。Miles 从 THUDM/slime 分叉而来,与 slime 保持共同演进。 核心架构:SGLang 负责高吞吐 rollout 生成 + NVIDIA MegatronL…
radixark/miles Jay 2026-09-12
nixfred/blip · 上手攻略
Blip 是一个在 Linux 桌面上收发 iMessage 的工具,通过让同一局域网(或 Tailscale 网络)内的 Mac 充当"网关"来实现——Mac 保持登录你的 Apple ID、运行 AppleScript 脚本处理消息,Linux 端只是一个轻薄的客户端界面(Omarchy 面板插件 + 独立 App)。 ⚠️ 前提条件:必须有一台 Mac…
工程化 nixfred/blip Stars 127 Jay 2026-09-05
THU-BPM/MarkLLM · 上手攻略
MarkLLM 是清华大学 BPM 实验室开源的 LLM 水印工具包,发表在 EMNLP 2024 Demo,现已收录为 pip install markllm 包。它统一实现了当前主流的 LLM 文本水印算法(KGW、EXP、Unforgeable、SynthIDText 等 20+ 种),并提供标准化的评估流程(抗攻击测试、可视化工具),让研究者和工程师…
安全与风险 THU-BPM/MarkLLM Stars 1,067 Jay 2026-09-04
2akouwu/reverify · 上手攻略
Reverify 是一个AI 辅助逆向工程工具包,核心解决 AI 在二进制逆向场景下"一本正经地胡说八道"的问题。它将语言模型置于确定性 RE 工具链的裁判之下:模型提出假设,工具链在真实二进制上验证,只有在 disassemble、patternmatch 或 emulator 执行后确认的结论才对外报告。 MIT 许可证,当前版本 v0.3.0,纯 Py…
Agent 智能体 2akouwu/reverify Stars 950 Jay 2026-09-03
google/sam · 上手攻略
SAM(Sovereign Agent Mesh)是由 Google 开发的一个零配置、零信任的 P2P 网络,专为自主 AI Agent 设计。它让 AI Agent 节点自动发现彼此、互相认证,并通过标准 MCP(Model Context Protocol)协议跨节点调用工具——不依赖将内部脚本或 API 暴露到公网。 当前状态:公开测试网(banan…
Agent 智能体 google/sam Stars 808 Jay 2026-09-01
jeremylongshore/tons-of-skills-marketplace · 上手攻略
Tons of Skills 是一个面向 Claude Code 的开源插件技能市场,由 Jeremy Longshore(Intent Solutions)维护。它将散落在各处社区的 Claude Code 技能(Skill)打包成可发现、可安装、可评级的插件集合,通过 npm 包 + Web 界面双通道分发。截至 20260819 数据:471 个插件、…
Agent 智能体 jeremylongshore/tons-of-skills-marketplace Stars 2,687 Jay 2026-09-01
midagedev/gadak · 上手攻略
gadak 是一个把 Jira 和 Confluence 同步到本地 SQLite 文件的开发者工具。它的核心价值主张很简单:把远程 API 调用变成本地 SQL 查询,让"哪个 Epic 实际卡住了?"这种需要 GROUP BY 的问题,从"无法回答"变成一条 SQL。 支持 macOS 桌面 App、Web UI、CLI 和 MCP 服务器(供 AI 编…
Agent 智能体 midagedev/gadak Stars 30 Jay 2026-08-30
micro/mu · 上手攻略
mu(读作 /mjuː/)是一个面向人类、AI 代理和服务的通用协议网络。它用一套协议栈(SMTP 收件、IMAP 读件、HTTP 服务、MCP 对接 Agent、XMPP 聊天、x402 支付)把邮件、工具、日历、文件、搜索等 100+ 项能力统一起来,让一个 AI Agent 可以像真人一样拥有自己的邮箱、联系人、日历和文件系统。 它的核心哲学是「地址即…
Agent 智能体 micro/mu Stars 394 Jay 2026-08-27
coderonion/awesome-llm-and-aigc · 上手攻略
coderonion/awesomellmandaigc 是一个 LLM / VLM / VLA / AIGC 领域的精选资源列表(Awesome List),按 Framework(模型/训练/推理/量化/RAG)、Application(IDE/聊天机器人/具身智能/代码助手/知识库等)、Dataset、Learning Resources、Commun…
多模态 coderonion/awesome-llm-and-aigc Stars 811 Jay 2026-08-25
brontoguana/krasis · 上手攻略
Krasis 是一个混合 LLM 推理运行时,专注于在消费级显存受限的 NVIDIA GPU 上高效运行数百亿参数级别的 MoE(Mixture of Experts)大模型。它的核心设计目标是:让一张或两张普通游戏显卡(如 RTX 5090 32 GB、RTX PRO 6000 96 GB)就能跑得动原本需要 H100/A100 才能加载的千亿参数模型。 …
LLM 基础设施 brontoguana/krasis Stars 512 Jay 2026-08-20
Dominic789654/awesome-deepseek-harness · 上手攻略
awesomedeepseekharness 是一个精选资源列表(Awesome List),收录 DeepSeek Harness(DSH)生态中最优质的插件、Skills、MCP 服务器、Patch/Profile 层、编排器和客户端。DeepSeek Harness 是 DeepSeek 官方发布的 Agent 运行时框架,核心理念是 Model + …
评测基准 Dominic789654/awesome-deepseek-harness Stars 133 Jay 2026-08-18
stacklok/toolhive · 上手攻略
ToolHive 是 Stacklok 开源的企业级 MCP(Model Context Protocol)服务器运行与管理平台,定位类似 MCP 界的"Kubernetes"——用容器隔离每一个 MCP 服务器,用声明式 API 集中管控注册表、网关、运行时和安全策略。 核心卖点三条: 1. 安全隔离:每个 MCP 服务器跑在独立容器里,凭证不泄露到本地,…
Agent 智能体 stacklok/toolhive Stars 2,000 Jay 2026-08-13