女性换装导演

SkillMedia

Generates coordinated image prompts and video scripts for "multi-outfit collage first frame of the same character + beat-synced outfit-change short videos". Use when the user asks for realistic character outfit collages, five outfits, floating character stickers, hanfu/ancient-style/modern fashion o

Available today. Use it from your connected AI after setup.

Connect ahel once, and every AI you use reads what you have installed.

Then ask your AI: use the 女性换装导演 skill

What this skill tells your AI

The instructions your AI receives, as published by liyue-aigc/female-outfit-director in skill/SKILL.md and read by ahel’s review.

目标

把一次角色穿搭需求转换为彼此联动的:

  1. 参数锁定结果
  2. 首帧拼贴图提示词
  3. 换装视频时间轴脚本
  4. 精简视频提示词
  5. 负面提示词 / 强制约束

图片是视频的结构母图。视频必须继承图片中的人物身份、服装、四周小人物位置、画面布局和摄影质感。

触发范围

在以下任务中使用:

  • 同一角色的多套穿搭拼贴图
  • 真人化角色 + 多套造型
  • 中央大人物 + 四周悬浮人物贴纸
  • 把角色穿搭图变成换装视频
  • 汉服、古风、国风、现代时尚、虚拟角色的卡点换装
  • 点击某个小人物 / 穿搭后完成变装
  • 先推荐参数组合,再生成图片和视频提示词
  • 上传参考图后沿用人物、服装和布局
  • 更换或推荐更有表现力的换装机制

普通单人写真、单套服装展示、纯剧情短片不使用本 Skill,除非用户明确要求多套换装联动。

工作模式

模式 A|直接生成

当用户已有参考图、人物设定或足够服装信息:

  • 锁定已有参数
  • 仅补全低风险缺失项
  • 直接输出图片提示词 + 视频脚本
  • 不重复询问已知信息

模式 B|参数推荐

当用户说“推荐几组参数”“先给方案”:

  • 先读 references/parameter-presets.md
  • 输出 4–8 组差异明显的参数组合
  • 暂不生成完整图片/视频提示词
  • 用户选定后进入模式 A

模式 C|参考图提取

当用户上传参考图并要求沿用:

  • 提取可见人物外貌、族裔外观、年龄感、发型、发色、头饰、耳饰
  • 区分中央主造型与四周造型
  • 提取人物位置、比例、朝向、背景、光线、描边形式
  • 看不清的非核心细节可系统补全
  • 不用文字模板覆盖图片中已经明确存在的设定

模式 D|换装机制改造

当用户已有脚本,只想更换变装方式:

  • 保留人物、服装、镜头、时长、布局
  • 只替换换装触发与相应动作
  • 先读 references/transition-library.md
  • 用户要多个方案时提供 3–6 个

参数锁定规则

用户明确给出的参数都是“锁定参数”,不得擅自替换、弱化或删除。

角色锚点

  • 角色名称 / 基础身份
  • 明确成年年龄或视觉年龄
  • 国籍 / 族裔外观
  • 脸型
  • 五官与神情
  • 肤色
  • 妆容
  • 眼睛
  • 发型 / 发色
  • 头饰 / 耳饰
  • 整体气质

国籍与族裔外观

  • 有参考图时,严格遵循参考图中可见的族裔外观,不使用默认值覆盖参考人物
  • 用户明确指定国籍或族裔外观时,严格使用用户设定
  • 没有参考图且用户未指定时,默认生成原创中国成年女性,以自然、真实的东亚面部特征呈现
  • 使用默认值时,必须在参数锁定结果、图片提示词和视频提示词中显式写明“中国成年女性”,不得只依赖中文语境
  • 除非用户明确要求,不得在无参考图场景中自动生成欧美面孔
  • 不使用服饰、妆容或文化符号代替族裔外观,不生成刻板化、夸张化面部特征

造型

  • 中央初始主造型
  • 造型 1
  • 造型 2
  • 造型 3
  • 造型 4

图片

  • 画幅
  • 拼贴布局
  • 背景
  • 光线
  • 主色系
  • 小人物描边

视频

  • 时长 / 比例
  • 机位与运镜
  • 换装机制
  • 动作基调
  • 卡点时间
  • 声音
  • 结尾动作

缺失参数处理

不要要求用户一次填完全部参数。

可自动补全

未明确时可使用,并在结果中标记 系统补全

  • 默认人物:无参考图且未指定国籍 / 族裔外观时,使用原创中国成年女性,视觉年龄 22–28 岁,自然东亚面部特征
  • 图片比例:9:16
  • 视频比例:9:16
  • 视频时长:8 秒
  • 背景:浅灰白无缝影棚
  • 光线:柔和漫射棚拍光
  • 小人物描边:白色手绘贴纸虚线
  • 视频默认固定机位
  • 默认无文字、品牌、Logo、水印
  • 默认基础点击 / 飞入 / 卡点音效

需要询问的情况

仅在高影响信息完全缺失且无法合理补全时问一个简短问题,例如:

  • 没有参考图,也没有任何角色设定
  • 要求多套服装但既没给服装,也没要求系统推荐
  • 用户要求的镜头与换装方式互相冲突且无法兼容

不要为了补齐参数表而逐项追问。

默认五人拼贴版式

除非用户明确指定其它版式:

  • 中央偏右:大型主体人物,约占画面宽度 60%–65%
  • 左上:小人物
  • 右上:小人物,默认腰部以上紧凑构图
  • 左侧中部:小人物
  • 左下:小人物
  • 右下:留白

硬规则:

  • 默认正好 5 个人物
  • 5 人必须是同一角色
  • 中央人物最大
  • 四个小人物明显更小
  • 小人物是沿真实身体轮廓裁切的完整人物抠像
  • 四个小人物各自有独立白色虚线描边
  • 中央人物不加虚线
  • 禁止第六个人物
  • 禁止用矩形缩略图替代人物抠像

用户明确要求 3–6 套造型时可改布局,但必须先在参数结果中说明新的布局逻辑。

首帧图片生成流程

按此顺序写完整版图片提示词:

  1. 画幅 + 超写实商业摄影任务
  2. 统一人物身份与外貌锚点
  3. 人物数量与拼贴布局
  4. 中央人物构图、姿态、主造型
  5. 四个小人物位置、构图、姿态、各自造型
  6. 白色虚线贴纸效果
  7. 背景、光线、镜头、皮肤、发丝、服装面料
  8. 主色系与画面气质
  9. 硬性限制
  10. 负面提示词

为视频兼容而优化

  • 小人物不要采用极端扭曲姿势
  • 头、肩、腰、手臂结构清晰
  • 小人物与中央人物的身体拓扑尽量兼容,便于重合换装
  • 袖摆、裙摆、披帛尽量完整,不要大幅裁切
  • 五个版本的脸、发型、发色、头饰、耳饰统一
  • 中央初始姿态要给后续动作留空间
  • 背景保持简洁

换装机制选择

若用户指定机制,严格使用。

若未指定:

  • 拼贴贴纸 + 互动选择:默认“完整人物飞入重合”(M1)
  • 汉服大袖 / 披帛:优先“长袖/袖摆遮镜”(M2),其次“团扇/折扇遮挡”(M5)
  • 古风贵女:优先“团扇/折扇遮挡”(M5)
  • 强拼贴设计:优先“贴纸翻页/人物剪影翻转”(M8)
  • 强节奏现代穿搭:优先“步伐/跺脚/手势卡点”(M10)
  • 需要分身概念或衣橱人格表达:可用“分身归位融合”(M9)
  • 东方幻想 / 神女:可用披帛、花瓣、云纹、水墨
  • 高级清冷时尚:可用旋身、镜面

需要详细机制或备选方案时读 references/transition-library.md

默认机制:完整人物飞入重合

  1. 指针点击目标小人物
  2. 复制出一个相同的完整人物抠像,作为飞入副本
  3. 原位置的目标小人物立即移除,不再保留,原位置留空
  4. 飞入副本沿斜线飞向中央并迅速放大
  5. 白色虚线始终贴合飞入副本的完整人物轮廓
  6. 飞入副本与中央人物的头、肩、腰、动作姿态重合
  7. 重合瞬间中央人物切换对应服装,飞入副本与虚线同时消失
  8. 换装后中央人物继续原动作

必须明确:

  • 飞入的是复制出的完整人物副本,不是单独衣服
  • 不是矩形卡片
  • 原位置的目标小人物不保留,飞入开始时立即消失并留空
  • 重合后中央只保留一个人物,不产生双影

视频时间轴生成流程

默认时长

默认 8 秒,5 套造型 = 初始造型 + 4 次换装。

默认换装完成点:

  • 第 1 次:约 1.25 秒
  • 第 2 次:约 2.95 秒
  • 第 3 次:约 4.40 秒
  • 第 4 次:约 6.55 秒

若总时长变化且用户未给卡点:

  • 按以上时间点相对 8 秒等比例缩放
  • 最后一段必须保留最终造型展示时间

若用户给了卡点:

  • 严格使用
  • 不擅自平均化

每段时间轴必须包含

  • 时间范围
  • 当前造型
  • 人物动作
  • 眼神 / 表情
  • 换装触发
  • 换装运动方向
  • 换装完成时刻
  • 换装后动作如何延续
  • 发丝 / 袖摆 / 裙摆 / 流苏物理
  • 必要音效

动作连续性

每次换装前后必须维持:

  • 重心连续
  • 旋转方向连续
  • 手臂轨迹连续
  • 头部朝向连续
  • 眼神变化有因果
  • 不因换衣重置姿势

使用“人物飞入重合”时:

  • 飞入人物必须在头、肩、腰、姿势相合后再完成服装替换

衣料物理

汉服、长裙、长袖、披帛、流苏必须:

  • 有自然重力
  • 转身时有轻微惯性延迟
  • 停止后逐渐回落
  • 换装瞬间不中断物理连续性
  • 不僵硬漂浮
  • 不穿模
  • 不粘连身体

镜头规则

默认固定高机位

适合拼贴式换装:

  • 摄影机位于人物前上方
  • 向下约 30–35°
  • 近距离高机位俯拍
  • 人物自然抬眼
  • 头部和上半身更靠近镜头
  • 裙摆向画面下方展开
  • 全程固定
  • 不推拉、不摇镜、不旋转、不变焦

若用户明确要求其它镜头,可用正面固定、轻微低机位、缓慢推近、轻微横移或半环绕。

短时长中不要同时叠加复杂运镜与复杂换装机制。

声音规则

默认无背景音乐,除非用户要求。

按机制加入:

  • 鼠标点击声
  • 飞入 / 滑动短促移动声
  • 换装完成卡点声
  • 轻微衣料摩擦声
  • 古风可加入极轻丝带、扇面、花瓣掠过声

声音只服务换装节点。

强制一致性约束

完整输出中必须明确:

  • 同一张脸
  • 同一成年年龄感
  • 同一国籍 / 族裔外观
  • 同一肤色
  • 同一发型 / 发色
  • 同一头饰 / 耳饰
  • 同一身材比例
  • 只改变穿搭,不重做人物
  • 换装前后动作连续
  • 已使用的小人物贴图原位置不保留
  • 不出现第六人物
  • 不出现矩形缩略图
  • 不出现双重中央人物 / 残影
  • 不服装叠穿
  • 不错误肢体 / 多余手指 / 身体融合
  • 不头部裁切
  • 不背景突变
  • 不无故镜头移动

输出协议

默认输出以下内容。

1)参数锁定结果

只列本次真正使用的参数,不机械输出空字段。

格式:

## 参数锁定结果
- 角色:
- 成年年龄感:
- 国籍 / 族裔外观:
- 外貌锚点:
- 发型 / 头饰 / 耳饰:
- 初始主造型:
- 造型1:
- 造型2:
- 造型3:
- 造型4:
- 拼贴布局:
- 图片比例:
- 视频比例:
- 视频时长:
- 镜头:
- 动作基调:
- 换装机制:
- 换装卡点:
- 声音:
- 系统补全:

Signals

GitHub stars
817
Forks
128
Last commit
Sep 2026
Advanced
Catalog kind
skill
Gateway key
female-outfit-director
Source
github.com/liyue-aigc/female-outfit-director