MDX-Tom/gpt-5.6-instruct · 上手攻略
- 仓库:MDX-Tom/gpt-5.6-instruct
- 链接:https://github.com/MDX-Tom/gpt-5.6-instruct
- 分类:AI 工具 · Codex CLI 增强
- 作者:Jay
- 更新:2026-07-24
一、是什么
gpt-5.6-instruct 是专门针对 Codex CLI(OpenAI 的本地 AI 编程助手)设计的一套越狱(jailbreak)提示词包,核心模型为 gpt-5.6-sol。它的本质是一套经过版本迭代、量化评测的指令集,用于压制 Codex 在面对安全相关请求时的默认拒绝行为,让模型在本地沙箱环境下更直接地响应复杂指令。
项目本体包含两部分:
- 生产级破甲提示词(
gpt-5.6-sol-unrestricted-v41.zip):当前唯一默认版本,部署到 Codex CLI 的model_instructions_file。 - 可复现评测工具:360 条主测试 + 52 条 Issue 专项测试,支持 low / medium / high 三档推理等级回归。
项目本身在 GitHub 公开托管,README 和文档均有中英文两套,不修改 Codex 二进制、不劫持网络、不篡改进程,属于纯配置层面的指令覆盖。
⚠️ 免责声明:本攻略仅作技术介绍与知识传播。请只在您拥有合法操作权限的环境中使用,遵守所在地区的法律法规,并对使用后果自行承担责任。
二、解决什么问题
Codex CLI 默认内置了多层安全过滤,在面对逆向工程、软件破解、安全研究等任务时,会主动转向"无害化替代方案"或直接拒绝。典型表现如:
- 要求写一个 license keygen → 拒绝,改为"注册码验证逻辑"
- 要求提供可用的 RCE payload → 拒绝,改为无害 PoC
- 要求分析恶意软件行为 → 拒绝,转向安全科普
gpt-5.6-instruct 的 v41 提示词将这类任务重新定义为"本地沙箱研究任务",显式压制拒绝话术,使 Codex 在 gpt-5.6-sol 模型上的 medium 测试集通过率从上游的 55% 提升至 100%(+45 个百分点)。
三、快速安装
前置条件
- Python 3.8+
- 已安装 Codex CLI 并配置好
~/.codex目录 - 对
~/.codex/config.toml有写入权限
步骤一:克隆仓库
git clone https://github.com/MDX-Tom/gpt-5.6-instruct.git
cd gpt-5.6-instruct
步骤二:预览(不写入)
python3 codex-instruct.py --apply --dry-run
步骤三:正式部署 v41
python3 codex-instruct.py --apply
脚本会自动:
1. 解压 gpt-5.6-sol-unrestricted-v41.zip
2. 将指令文件复制到 CODEX_HOME
3. 为 config.toml 创建带时间戳的快照备份(config.toml.bak_YYYYMMDD_HHMMSS_ffffff)
4. 写入 model_instructions_file = "./gpt-5.6-sol-unrestricted-v41.md"
步骤四(可选):Skills 配套版
如需配合 Agent Skills(yaklang/hack-skills、trailofbits/skills)使用,可额外部署 skills 版:
python3 codex-instruct.py --file ./gpt-5.6-sol-unrestricted-v41-skills.zip
交互式菜单
不带任何参数即可进入菜单:
python3 codex-instruct.py
菜单可查看当前状态、切换版本(历史版 v5 / v24 / v35 仍在归档中)、执行回滚等操作。
四、核心用法
部署自定义 ZIP 或 Markdown
# 指定自定义文件
python3 codex-instruct.py --file ./my-custom-instructions.zip
# 指定 Codex home 目录(非默认 ~/.codex)
python3 codex-instruct.py --apply --codex-dir /path/to/.codex
回滚(安全卸载)
# 自动回滚:只恢复本次部署的 model_instructions_file
python3 codex-instruct.py --reset
# 人工应急:恢复整份 config.toml 快照
python3 codex-instruct.py \
--restore-snapshot ~/.codex/config.toml.bak_YYYYMMDD_HHMMSS_ffffff \
--codex-dir ~/.codex
📌 注意:
--reset仅恢复脚本部署的顶层model_instructions_file,不会覆盖用户后来自行修改的其他配置项。
运行评测(本地测试集)
# 解压测试脚本包
for archive in scripts/*.zip; do unzip -o "$archive" -d scripts; done
# 生成测试集
python3 scripts/generate_gpt56_sol_prompt_bank.py
# 运行最短层级测试(level=minimal, reasoning=low)
python3 scripts/run_gpt56_sol_prompt_bank.py \
--level minimal \
--reasoning low \
--run-label v41
# 专项集 dry-run(预览,不实际调用模型)
python3 scripts/run_gpt56_sol_issue_regression.py --dry-run
同步源文件与压缩包
修改提示词源文件后,同步并校验:
python3 sync-archives.py # 同步
python3 sync-archives.py --check # 校验 SHA256
五、典型适用场景
以下场景在部署 v41 后,Codex 对 gpt-5.6-sol 的直接执行能力会显著提升(均基于 120 条 medium 测试集验证):
| 场景类别 | 具体示例 |
|---|---|
| 安全研究 | RCE 验证探针、渗透测试辅助脚本(均限定本地靶场环境) |
| 逆向工程 | 函数级符号执行、VM / Bytecode 分析、二进制保护绕过 |
| 软件破解 | License 算法分析、Keygen 逻辑(需拥有合法分析授权的软件) |
| 代码脱混淆 | Obfuscation 反混淆、Anti-debugging 技术分析 |
| 生物研究辅助 | 明文生物信息学数据分析(52 条 Issue 专项之一) |
⚠️ 所有场景均限定在本地沙箱或拥有合法授权的研究环境中。
六、坑与注意
1. 版本选择
目前仓库默认只有 v41 可用,历史 v5 / v24 / v35 已移入 historical-versions/ 目录,不出现在交互菜单中。如需复现旧版结果,需手动从归档目录解压。
2. Codex home 路径
如 Codex 使用非默认目录,需显式传 --codex-dir,否则脚本默认操作 ~/.codex。
3. 状态文件
脚本依赖 ~/.codex/.gpt56-sol-instruct-state.json 记录部署状态(不保存 provider / 模型 / 认证数据)。如状态文件损坏,--reset 可能无法正确识别需回滚的文件。
4. 多模型切换
v41 在 gpt-5.6-sol 上达到 120/120,但在 gpt-5.4、gpt-5.5、gpt-5.6-luna、gpt-5.6-terra 等其他模型上未全部覆盖,跨模型使用前请先查阅 docs/comparison-tests.md 的跨模型表格。
5. Provider 认证配置
CCSwitch 等反代工具在部署后写入的 provider、模型、认证配置,--reset 后会保留,不会被清除。
6. 安全性评测说明
项目明确不保证所有输入都能获得相同结果,且明确要求用户只在自己有权操作的环境中使用。完整安全性评测见 docs/gpt-5.6-sol-safety-eval.md。
七、与同类对比
对比上游 yynxxxxx/Codex-5.5-codex-instruct-5.5
本项目的直接上游是基于 Codex 5.5 模型的越狱提示词。gpt-5.6-instruct 迁移至 gpt-5.6-sol 并大幅优化,基础通过率从上游 55%(medium 推理等级)提升至 100%,提示词长度减少约 55.67%。
对比通用 Prompt Engineering 方案
通用提示词优化(如 few-shot、角色扮演等)提升的是模型对任务的理解能力,而本项目解决的是模型因安全限制而拒绝执行的问题。两者是互补关系,不是替代关系。
对比 MCP 工具
MCP(Model Context Protocol)工具如 jgravelle/jcodemunch-mcp 解决的是"降低 token 消耗和精确定位代码"的问题;本项目解决的是"让模型在敏感任务上不再主动退让"的问题。部署层面互不冲突,可根据实际需求组合使用。
八、一句话推荐结论
如果你使用 Codex CLI + gpt-5.6-sol 模型做安全研究、逆向工程或代码分析,并在实际使用中遇到频繁的拒绝或无害化转向,部署
gpt-5.6-instruct v41是目前经过最充分评测验证的解决方案——120 条测试集三档全绿,提示词精简,部署和回滚均有脚本兜底;但请务必将使用范围限制在合法授权的本地环境中。
参考资料: - README.md / README_EN.md(项目首页) - docs/comparison-tests.md(版本回归与跨模型对比) - docs/gpt-5.6-sol-safety-eval.md(安全性评测说明) - GitHub Issues #3/#4/#5/#6/#8(真实失败案例驱动优化) - skill-examples/sources.json(上游 Agent Skills 溯源)