elder-plinius/T3MP3ST · 上手攻略
- 仓库:elder-plinius/T3MP3ST
- 链接:https://github.com/elder-plinius/T3MP3ST
- 分类:agent · risk · trending
- 作者:Tom
- 更新:2026-07-08
这是什么
T3MP3ST(念作 "tempest")是一个自主红队平台,用多 Agent 协作把 AI 编程助手(Claude Code、Codex、Hermes)变成漏洞猎人。它的核心理念是:你已经在用的 AI 编程 Agent 就是大脑,T3MP3ST 围绕它构建一套攻击性武器库——侦察(Recon)→ 利用(Exploit)→ 报告(Report),一条龙的杀伤链(kill chain)。
作者极为诚实:框架文档里把每个模块标记为 ✅ Stable(已验证)、⚠️ Experimental(实验性)、🚧 Planned(规划中),不允许"感觉能用"就发货。官方数据:XBEN(XBOW)104 道黑盒渗透挑战 pass@1 达 90.1%(官方自报 85%),比 XBOW 自己的基准还高;10 道 2026 年后真实 CVE 盲测,8/10 精确定位文件/行/CWE。它喊出的口号是"无密钥作战"(keyless)——你可以不提供任何 API key,直接用本机已有的 Claude Code 等 Agent 驱动整个流程。
定位:进攻性安全研究、授权渗透测试、CTF 训练、漏洞赏金猎人、SOC 红队演练。
解决什么问题
传统渗透测试靠人工经验和昂贵工具集,AI 编码助手虽然强但没有"攻击者视角"的工具链。T3MP3ST 把 AI Agent 已经具备的代码理解和推理能力,与真实攻击工具(nmap、SQLMap、Dirsearch 等)串联起来,让机器执行完整的杀伤链,而不只是生成 PoC。
它的目标是把"零经验也能挖到真实漏洞"这件事变成可能——只要你有授权目标。
快速安装
环境要求
- 操作系统:macOS / Linux(Windows 通过 WSL2 兼容)
- 运行时:Node.js ≥ 20(含 npm)
- 可选(keyless 模式不需要):Claude Code / Codex 已登录本机,或 Ollama / LM Studio / vLLM 本地模型服务
安装步骤
git clone https://github.com/elder-plinius/T3MP3ST.git
cd T3MP3ST
npm install
启动 War Room(浏览器可视化界面)
npm run server
# 访问 http://127.0.0.1:3333/ui/
War Room 里打开 Settings,连接本机已有的 Agent(Claude Code / Codex / Hermes),无需 API key。
带 API key(跳过连接步骤)
export OPENROUTER_API_KEY=... # OpenRouter
export XAI_API_KEY=... # Grok Build(xAI 编码模型,原生工具调用)
# 或
export ANTHROPIC_API_KEY=...
export OPENAI_API_KEY=...
完全离线(Ollama)
ollama serve && ollama pull llama3 # 或任意 OpenAI-compatible 模型
export TEMPEST_LOCAL_BASE_URL=http://localhost:11434/api
export TEMPEST_LOCAL_MODEL=llama3
npx tempest config # 交互式配置本地模型
验证官方数据(可重复审计)
npm run verify-claims
# 重新从 committed JSON 推算所有 README 里的数字
# 24/24 检查点全部绿色为通过
核心用法
方式一:War Room(推荐新手)
- 启动服务器:
npm run server - 浏览器打开
http://127.0.0.1:3333/ui/ - Settings → 连接本机 Agent(Claude Code / Codex)
- 对 Op Admiral 用自然语言描述目标:"对这个 URL 进行 Web 渗透测试"
- Agent 自动执行 Recon → Exploit → Report,杀伤链全自动
方式二:CLI
# War Room 也支持 CLI 模式,参见 docs/ 下的 HTTP API 文档
方式三:MCP Server(接入其他 Agent)
T3MP3ST 自带 MCP 服务器,被连接的 Agent 可调用 35 个内置工具(83 个含完整军火库 T3MP3ST_FULL_ARSENAL):
# 激活完整军火库(需人类审批高危工具)
export T3MP3ST_FULL_ARSENAL=1
npx t3mp3st mcp-server
关键模块状态一览
| 域 | 功能 | 状态 |
|---|---|---|
| 🕸️ Web 应用 | 黑盒外部侦察→利用(XBEN suite) | ✅ Stable |
| 🚩 CTF | 无提示沙盒解题(Cybench) | ✅ Stable |
| 🤖 嵌入式/IoT/OT | CVE 协调披露管道 | ✅ Stable |
| 📂 源代码 | 白盒仓库分析(Python 为主) | ⚠️ Experimental |
| 💰 智能合约 | Damn Vulnerable DeFi | ⚠️ 复现,非新发现 |
| ☁️ 云(IaC) | 误配置检测 | 🚧 开发中 |
| 📱 移动端 | 静态分析 | 🚧 开发中 |
| 🔩 二进制/RE | 逆向工程 | 🚧 开发中 |
典型适用场景
授权渗透测试:描述目标 URL,T3MP3ST 自动跑完整杀伤链,适合 Bug Bounty 和内部红队。
CTF 训练:Cybench 基准 23/40 无提示解题,可用于自动化 CTF 刷题。
源代码审计:Python 仓库输入,白盒分析漏洞(⚠️ Experimental,需 Python regex ingest)。
CVE 复现:给定 CVE ID,自动跑 OSV + live PoC + refuter 协调披露管道。
SOC 演练:攻击方自动化 vs 防守方蓝队的对抗演练。
坑与注意
-
⚠️ 只打授权目标:T3MP3ST 自带出站范围限制(scope containment),一旦设置目标,内置网络工具拒绝访问目标外的公共主机,但使用者本人须对法律合规负责。未授权测试在大多数司法管辖区违法。
-
⚠️ Swarm 协同未验证:框架设计了 8 个 Operator(Recon / Exploiter / Infiltrator / Exfiltrator / Ghost 等),但目前所有基准数据均来自单 Agent ReAct 循环。多人 Agent 协同作战的效果尚未被基准验证。
-
⚠️ 源代码分析仅 Python:当前 ingest 为 Python regex,多语言源码分析token 消耗更高,效果有限。
-
⚠️ 智能合约仅复现:它能复现已知漏洞利用,但不会主动发现新漏洞。
-
工具审批机制:完整军火库(metasploit、hydra 等高危工具)需要人类审批步骤,不会全自动执行。
-
API Key 安全:不要把 key 直接写在命令里传入环境变量,使用
~/.bashrc或.env+.gitignore。
与同类对比
| 项目 | T3MP3ST | Metasploit | Burp Suite + AI |
|---|---|---|---|
| 驱动方式 | AI Agent + 工具链 | 规则引擎 | 手动 + AI 辅助 |
| Keyless | ✅(用本机 Agent) | ❌ | ❌ |
| 可验证基准 | ✅(npm verify-claims) | ⚠️ | ❌ |
| 自动化程度 | 全自动杀伤链 | 半自动 | 低 |
| 多 Agent 协同 | 架构有,基准无 | 不支持 | 不支持 |
| 支持域 | Web/CTF/代码/嵌入式 | 全域 | Web 为主 |
| 许可 | AGPL-3.0 | AGPL | 商业 |
一句话推荐结论
如果你已经在用 Claude Code 或 Codex,且有授权渗透测试需求,T3MP3ST 是目前最诚实的 AI 驱动红队框架——90.1% XBEN 通过率可重复验证,keyless 模式零额外成本,但 Swarm 多 Agent 协同和云/移动端攻击仍是 Roadmap,建议从小目标 Web/CTF 开始。
来源
- GitHub README(https://github.com/elder-plinius/T3MP3ST)
- OSSInsight(https://ossinsight.io/analyze/elder-plinius/T3MP3ST)
- docs/FEATURES.md、docs/INTEGRITY_LEDGER.md(README 内链引用)
不确定处
- T3MP3ST 的 War Room UI 具体交互流程,因无法实际操作,描述基于 README 文字推断。
- Swarm 协同(Exploiter/Infiltrator/Exfiltrator/Ghost 联动)的实测效果,因基准数据未覆盖,以官方 Roadmap ⚠️ 标记为准。
npm run server的完整依赖树版本建议,README 未给出 Node 版本要求以外的具体约束。