Imported from liyue-aigc/female-outfit-director (
skill/SKILL.md). Install upstream withnpx skills add liyue-aigc/female-outfit-director --skill skill. Copyright stays with the author.
女性换装导演
目标
把一次角色穿搭需求转换为彼此联动的:
- 参数锁定结果
- 首帧拼贴图提示词
- 换装视频时间轴脚本
- 精简视频提示词
- 负面提示词 / 强制约束
图片是视频的结构母图。视频必须继承图片中的人物身份、服装、四周小人物位置、画面布局和摄影质感。
触发范围
在以下任务中使用:
- 同一角色的多套穿搭拼贴图
- 真人化角色 + 多套造型
- 中央大人物 + 四周悬浮人物贴纸
- 把角色穿搭图变成换装视频
- 汉服、古风、国风、现代时尚、虚拟角色的卡点换装
- 点击某个小人物 / 穿搭后完成变装
- 先推荐参数组合,再生成图片和视频提示词
- 上传参考图后沿用人物、服装和布局
- 更换或推荐更有表现力的换装机制
普通单人写真、单套服装展示、纯剧情短片不使用本 Skill,除非用户明确要求多套换装联动。
工作模式
模式 A|直接生成
当用户已有参考图、人物设定或足够服装信息:
- 锁定已有参数
- 仅补全低风险缺失项
- 直接输出图片提示词 + 视频脚本
- 不重复询问已知信息
模式 B|参数推荐
当用户说“推荐几组参数”“先给方案”:
- 先读
references/parameter-presets.md - 输出 4–8 组差异明显的参数组合
- 暂不生成完整图片/视频提示词
- 用户选定后进入模式 A
模式 C|参考图提取
当用户上传参考图并要求沿用:
- 提取可见人物外貌、族裔外观、年龄感、发型、发色、头饰、耳饰
- 区分中央主造型与四周造型
- 提取人物位置、比例、朝向、背景、光线、描边形式
- 看不清的非核心细节可系统补全
- 不用文字模板覆盖图片中已经明确存在的设定
模式 D|换装机制改造
当用户已有脚本,只想更换变装方式:
- 保留人物、服装、镜头、时长、布局
- 只替换换装触发与相应动作
- 先读
references/transition-library.md - 用户要多个方案时提供 3–6 个
参数锁定规则
用户明确给出的参数都是“锁定参数”,不得擅自替换、弱化或删除。
角色锚点
- 角色名称 / 基础身份
- 明确成年年龄或视觉年龄
- 国籍 / 族裔外观
- 脸型
- 五官与神情
- 肤色
- 妆容
- 眼睛
- 发型 / 发色
- 头饰 / 耳饰
- 整体气质
国籍与族裔外观
- 有参考图时,严格遵循参考图中可见的族裔外观,不使用默认值覆盖参考人物
- 用户明确指定国籍或族裔外观时,严格使用用户设定
- 没有参考图且用户未指定时,默认生成原创中国成年女性,以自然、真实的东亚面部特征呈现
- 使用默认值时,必须在参数锁定结果、图片提示词和视频提示词中显式写明“中国成年女性”,不得只依赖中文语境
- 除非用户明确要求,不得在无参考图场景中自动生成欧美面孔
- 不使用服饰、妆容或文化符号代替族裔外观,不生成刻板化、夸张化面部特征
造型
- 中央初始主造型
- 造型 1
- 造型 2
- 造型 3
- 造型 4
图片
- 画幅
- 拼贴布局
- 背景
- 光线
- 主色系
- 小人物描边
视频
- 时长 / 比例
- 机位与运镜
- 换装机制
- 动作基调
- 卡点时间
- 声音
- 结尾动作
缺失参数处理
不要要求用户一次填完全部参数。
可自动补全
未明确时可使用,并在结果中标记 系统补全:
- 默认人物:无参考图且未指定国籍 / 族裔外观时,使用原创中国成年女性,视觉年龄 22–28 岁,自然东亚面部特征
- 图片比例:9:16
- 视频比例:9:16
- 视频时长:8 秒
- 背景:浅灰白无缝影棚
- 光线:柔和漫射棚拍光
- 小人物描边:白色手绘贴纸虚线
- 视频默认固定机位
- 默认无文字、品牌、Logo、水印
- 默认基础点击 / 飞入 / 卡点音效
需要询问的情况
仅在高影响信息完全缺失且无法合理补全时问一个简短问题,例如:
- 没有参考图,也没有任何角色设定
- 要求多套服装但既没给服装,也没要求系统推荐
- 用户要求的镜头与换装方式互相冲突且无法兼容
不要为了补齐参数表而逐项追问。
默认五人拼贴版式
除非用户明确指定其它版式:
- 中央偏右:大型主体人物,约占画面宽度 60%–65%
- 左上:小人物
- 右上:小人物,默认腰部以上紧凑构图
- 左侧中部:小人物
- 左下:小人物
- 右下:留白
硬规则:
- 默认正好 5 个人物
- 5 人必须是同一角色
- 中央人物最大
- 四个小人物明显更小
- 小人物是沿真实身体轮廓裁切的完整人物抠像
- 四个小人物各自有独立白色虚线描边
- 中央人物不加虚线
- 禁止第六个人物
- 禁止用矩形缩略图替代人物抠像
用户明确要求 3–6 套造型时可改布局,但必须先在参数结果中说明新的布局逻辑。
首帧图片生成流程
按此顺序写完整版图片提示词:
- 画幅 + 超写实商业摄影任务
- 统一人物身份与外貌锚点
- 人物数量与拼贴布局
- 中央人物构图、姿态、主造型
- 四个小人物位置、构图、姿态、各自造型
- 白色虚线贴纸效果
- 背景、光线、镜头、皮肤、发丝、服装面料
- 主色系与画面气质
- 硬性限制
- 负面提示词
为视频兼容而优化
- 小人物不要采用极端扭曲姿势
- 头、肩、腰、手臂结构清晰
- 小人物与中央人物的身体拓扑尽量兼容,便于重合换装
- 袖摆、裙摆、披帛尽量完整,不要大幅裁切
- 五个版本的脸、发型、发色、头饰、耳饰统一
- 中央初始姿态要给后续动作留空间
- 背景保持简洁
换装机制选择
若用户指定机制,严格使用。
若未指定:
- 拼贴贴纸 + 互动选择:默认“完整人物飞入重合”(M1)
- 汉服大袖 / 披帛:优先“长袖/袖摆遮镜”(M2),其次“团扇/折扇遮挡”(M5)
- 古风贵女:优先“团扇/折扇遮挡”(M5)
- 强拼贴设计:优先“贴纸翻页/人物剪影翻转”(M8)
- 强节奏现代穿搭:优先“步伐/跺脚/手势卡点”(M10)
- 需要分身概念或衣橱人格表达:可用“分身归位融合”(M9)
- 东方幻想 / 神女:可用披帛、花瓣、云纹、水墨
- 高级清冷时尚:可用旋身、镜面
需要详细机制或备选方案时读 references/transition-library.md。
默认机制:完整人物飞入重合
- 指针点击目标小人物
- 复制出一个相同的完整人物抠像,作为飞入副本
- 原位置的目标小人物立即移除,不再保留,原位置留空
- 飞入副本沿斜线飞向中央并迅速放大
- 白色虚线始终贴合飞入副本的完整人物轮廓
- 飞入副本与中央人物的头、肩、腰、动作姿态重合
- 重合瞬间中央人物切换对应服装,飞入副本与虚线同时消失
- 换装后中央人物继续原动作
必须明确:
- 飞入的是复制出的完整人物副本,不是单独衣服
- 不是矩形卡片
- 原位置的目标小人物不保留,飞入开始时立即消失并留空
- 重合后中央只保留一个人物,不产生双影
视频时间轴生成流程
默认时长
默认 8 秒,5 套造型 = 初始造型 + 4 次换装。
默认换装完成点:
- 第 1 次:约 1.25 秒
- 第 2 次:约 2.95 秒
- 第 3 次:约 4.40 秒
- 第 4 次:约 6.55 秒
若总时长变化且用户未给卡点:
- 按以上时间点相对 8 秒等比例缩放
- 最后一段必须保留最终造型展示时间
若用户给了卡点:
- 严格使用
- 不擅自平均化
每段时间轴必须包含
- 时间范围
- 当前造型
- 人物动作
- 眼神 / 表情
- 换装触发
- 换装运动方向
- 换装完成时刻
- 换装后动作如何延续
- 发丝 / 袖摆 / 裙摆 / 流苏物理
- 必要音效
动作连续性
每次换装前后必须维持:
- 重心连续
- 旋转方向连续
- 手臂轨迹连续
- 头部朝向连续
- 眼神变化有因果
- 不因换衣重置姿势
使用“人物飞入重合”时:
- 飞入人物必须在头、肩、腰、姿势相合后再完成服装替换
衣料物理
汉服、长裙、长袖、披帛、流苏必须:
- 有自然重力
- 转身时有轻微惯性延迟
- 停止后逐渐回落
- 换装瞬间不中断物理连续性
- 不僵硬漂浮
- 不穿模
- 不粘连身体
镜头规则
默认固定高机位
适合拼贴式换装:
- 摄影机位于人物前上方
- 向下约 30–35°
- 近距离高机位俯拍
- 人物自然抬眼
- 头部和上半身更靠近镜头
- 裙摆向画面下方展开
- 全程固定
- 不推拉、不摇镜、不旋转、不变焦
若用户明确要求其它镜头,可用正面固定、轻微低机位、缓慢推近、轻微横移或半环绕。
短时长中不要同时叠加复杂运镜与复杂换装机制。
声音规则
默认无背景音乐,除非用户要求。
按机制加入:
- 鼠标点击声
- 飞入 / 滑动短促移动声
- 换装完成卡点声
- 轻微衣料摩擦声
- 古风可加入极轻丝带、扇面、花瓣掠过声
声音只服务换装节点。
强制一致性约束
完整输出中必须明确:
- 同一张脸
- 同一成年年龄感
- 同一国籍 / 族裔外观
- 同一肤色
- 同一发型 / 发色
- 同一头饰 / 耳饰
- 同一身材比例
- 只改变穿搭,不重做人物
- 换装前后动作连续
- 已使用的小人物贴图原位置不保留
- 不出现第六人物
- 不出现矩形缩略图
- 不出现双重中央人物 / 残影
- 不服装叠穿
- 不错误肢体 / 多余手指 / 身体融合
- 不头部裁切
- 不背景突变
- 不无故镜头移动
输出协议
默认输出以下内容。
1)参数锁定结果
只列本次真正使用的参数,不机械输出空字段。
格式:
## 参数锁定结果
- 角色:
- 成年年龄感:
- 国籍 / 族裔外观:
- 外貌锚点:
- 发型 / 头饰 / 耳饰:
- 初始主造型:
- 造型1:
- 造型2:
- 造型3:
- 造型4:
- 拼贴布局:
- 图片比例:
- 视频比例:
- 视频时长:
- 镜头:
- 动作基调:
- 换装机制:
- 换装卡点:
- 声音:
- 系统补全: