liyue-aigc/female-portrait-director · 上手攻略
- 仓库:liyue-aigc/female-portrait-director
- 链接:https://github.com/liyue-aigc/female-portrait-director
- 分类:academic-writing / image-prompt
- 作者:Jay
- 更新:2026-08-09
这是什么
female-portrait-director 是一个模块化的 Codex Skill(也兼容 Claude Code / Cursor / GitHub Copilot / Gemini CLI),作用是把零散的人像参数——如风格、场景、服装、情绪——转化为一组结构化的、可以直接复制使用的 AI 生图提示词,输出包含最终提示词(5 个完整段落)和独立的负面约束词块。
它的核心定位不是"提示词收藏"(prompt collection),而是摄影导演式扩展:给定几个关键词,它用视觉推理补全缺失细节,生成一个"可拍摄的真实瞬间",而不是机械填表或摘要复述。
⚠️ 注意:生成的subjects限定为虚构成人女性,除非用户提供已授权的参考图片(authorized adult reference)才能保留身份特征。
解决什么问题
用自然语言让 AI 生成一张人像时,最常见的问题是输出"风格打架"(赛博朋克光照配古风服装)、"细节残缺"(场景有了但光线和构图没交代)、"画面太薄"(只有主体没有时间切片和事件感)。
这个 Skill 的设计目标是:接收用户明确指定的参数 → 只扩展不替换 → 填入缺失视觉维度 → 一次输出五段完整提示词块 + 负面约束。相当于一个把"我要一张温柔的女友照"翻译成可拍摄分镜脚本的 AI 摄影导演。
快速安装
方式一:skills CLI(推荐)
# 安装(Node.js 必需)
npx skills add https://github.com/liyue-aigc/female-portrait-director/tree/main/skills/female-portrait-director -g
# 更新已安装副本
npx skills@latest update female-portrait-director -g -y
方式二:Git 克隆到 Codex 本地目录
macOS / Linux:
git clone https://github.com/liyue-aigc/female-portrait-director.git \
"${CODEX_HOME:-$HOME/.codex}/skills/female-portrait-director"
Windows PowerShell:
git clone https://github.com/liyue-aigc/female-portrait-director.git "$env:USERPROFILE\.codex\skills\female-portrait-director"
安装后重启 Codex 或开启新对话,调用方式:
$female-portrait-director
首次无参数调用会展示 V1.6 教程,包含全部 20 种已实现风格、基础/高级模板和完整工作流。
核心用法
标准工作流(参数 → 提示词)
在 Codex 对话中输入如下格式的参数块:
Portrait style: Gufeng xianxia beauty portrait
Scene: Traditional courtyard corridor surrounded by misty mountains and water
Outfit: Moon-white Tang-inspired fantasy wide-sleeve robe + flowing pibo scarf + silver embroidered waist sash
Mood: Cool, distant, ethereal
Facial direction: Classical East Asian beauty
Body direction: Slender and delicate figure
Camera direction: Slight side-facing standing pose, half-body to thigh framing
Lighting: Cool soft light
Filter: Cool ethereal gufeng filter
Aspect ratio: 9:16
Platform use: Character portrait
Skill 内部经过以下处理链路(用户不可见):
1. 参数锁定:原样保留用户明确指定的字段,不替换
2. 视觉路由:根据 compound fingerprint 匹配 20 种风格路线之一(如 CCD curve / low-key cinematic 等不可仅凭单个词选择)
3. 导演扩展:补充年龄暗示、五官特征、表情、身体方向、姿势、服装细节、光线、滤镜等模块
4. 融合输出:生成 5 个完整段落的 text 代码块(可直接复制进 MJ / SD / FLUX 等工具)和独立的负面约束块
风格菜单(20 种已实现风格)
| 类别 | 风格名称 |
|---|---|
| 生活方式 | Clean lifestyle、Curve-focused lifestyle、Studio-retouched |
| 时尚 | Urban fashion、E-commerce clothing model |
| 古风/东方 | Gufeng fantasy、Retro Hong Kong、French relaxed、New Chinese oriental、Cold xianxia enhanced、Bright luxury gufeng、Ancient noblewoman dewy-makeup |
| 人像特写 | Ultra-close realistic face |
| 暗调摄影 | Low-key cinematic photography |
| CCD/胶片感 | Black-pearl dark-gold CCD curve、Energetic voluptuous soft-CCD lifestyle、Cold-white clear CCD curve |
| 其他 | Sporty active、Travel vacation、Oriental voluptuous |
⚠️ 路由匹配规则:不可仅凭
CCD或curve一个词在三个 CCD curve 路线中选一;不可仅凭dark或cinematic单独选择low-key-cinematic-photography,需要组合指纹。
直接生成图片(需要图像模型接入)
若对话环境已接入图像生成工具,在请求末尾加上"generate an image directly",Skill 会直接调用图像模型而非只输出文字提示词。
参考图保留工作流
当用户上传授权参考图(已获准保留身份或产品特征),需要先读取 skill/core/reference-image-lock.md,建立 image-role lock table,再应用选定路线。
典型适用场景
- AI 生图调试:提示词反复生成效果不佳,需要系统性结构化扩展
- 多风格对比:同一参数在不同风格路线下的导演式展开(如古风 vs. 都市时尚)
- 电商服装图:服装展示优先模式(clothing-display priority)
- 内容创作:小红书 / 短视频封面图的分镜式提示词生成
- Curve-focused 场景:特定身体曲线导向的人像(需明确成人授权)
坑与注意
- 路由选择要完整:仅说
CCD或dark会导致路线选择失败,Skill 不会自动补救——必须提供完整的 compound fingerprint 组合。 - 首次调用输出的是教程:无参数调用
$female-portrait-director触发的是 V1.6 入门教程,不是实际生成;真正生成需要提供至少一个可操作的 portrait 参数。 - 标准输出 ≠ 简洁模式:默认输出(参数锁定 + 导演模块扩展 + 五段提示词 + 负面约束)内容很多,只有用户显式要求"简洁"时才会缩短。
- output 格式:最终提示词和负面约束分别渲染为两个独立的
text语言标签 Markdown 代码块,注释和路线笔记不会混入其中。 - 授权要求严格:subjects 限定虚构成人女性,涉及真实人物图像必须有明确授权。
- 非 Codex 代理的图像生成:Claude Code / Cursor / Copilot / Gemini CLI 行仅验证了包安装和格式兼容性,不代表每个宿主都接入了图像模型。
与同类对比
| 工具 | 定位 | 扩展方式 | 输出格式 |
|---|---|---|---|
| 本 Skill | 摄影导演式结构化扩展 | 视觉推理 + 模块补全 | 5段提示词 + 负面约束块 |
| Midjourney 提示词模板 | 风格模板填充 | 关键词选择 | 单段提示词 |
| PromptPerfect / 各类提示词优化器 | 语言优化 | 翻译/润色 | 改写后的单段提示词 |
| Stable Diffusion WebUI 标签器 | 图像→标签 | 图像识别打标 | 标签列表 |
本 Skill 的差异化在于视觉推理链(每个模块都有独立的视觉决策逻辑)和摄影导演意图(输出是"可拍摄的真实瞬间",不是关键词列表),代价是上手门槛稍高(需要理解 style+overlay 路由规则)。
一句话推荐结论
如果你是 AI 生图重度用户,需要把模糊的情绪/风格描述转化为精准、可拍摄的五段式提示词,Codex + female-portrait-director 是在文字→图像之间加了一层"摄影导演思维"的实用组合;非 Codex 用户也可以独立安装 SKILL.md 提取工作流逻辑使用。
主要来源: - https://github.com/liyue-aigc/female-portrait-director(README.md / SKILL.md) - 安装命令版本:skills CLI(未标注具体小版本)