女性换装导演
SkillMediaGenerates coordinated image prompts and video scripts for "multi-outfit collage first frame of the same character + beat-synced outfit-change short videos". Use when the user asks for realistic character outfit collages, five outfits, floating character stickers, hanfu/ancient-style/modern fashion o
Available today. Use it from your connected AI after setup.
No other account needed.
Connect ahel once, and every AI you use reads what you have installed.
Then ask your AI: use the 女性换装导演 skill
What this skill tells your AI
The instructions your AI receives, as published by liyue-aigc/female-outfit-director in skill/SKILL.md and read by ahel’s review.
目标
把一次角色穿搭需求转换为彼此联动的:
- 参数锁定结果
- 首帧拼贴图提示词
- 换装视频时间轴脚本
- 精简视频提示词
- 负面提示词 / 强制约束
图片是视频的结构母图。视频必须继承图片中的人物身份、服装、四周小人物位置、画面布局和摄影质感。
触发范围
在以下任务中使用:
- 同一角色的多套穿搭拼贴图
- 真人化角色 + 多套造型
- 中央大人物 + 四周悬浮人物贴纸
- 把角色穿搭图变成换装视频
- 汉服、古风、国风、现代时尚、虚拟角色的卡点换装
- 点击某个小人物 / 穿搭后完成变装
- 先推荐参数组合,再生成图片和视频提示词
- 上传参考图后沿用人物、服装和布局
- 更换或推荐更有表现力的换装机制
普通单人写真、单套服装展示、纯剧情短片不使用本 Skill,除非用户明确要求多套换装联动。
工作模式
模式 A|直接生成
当用户已有参考图、人物设定或足够服装信息:
- 锁定已有参数
- 仅补全低风险缺失项
- 直接输出图片提示词 + 视频脚本
- 不重复询问已知信息
模式 B|参数推荐
当用户说“推荐几组参数”“先给方案”:
- 先读
references/parameter-presets.md - 输出 4–8 组差异明显的参数组合
- 暂不生成完整图片/视频提示词
- 用户选定后进入模式 A
模式 C|参考图提取
当用户上传参考图并要求沿用:
- 提取可见人物外貌、族裔外观、年龄感、发型、发色、头饰、耳饰
- 区分中央主造型与四周造型
- 提取人物位置、比例、朝向、背景、光线、描边形式
- 看不清的非核心细节可系统补全
- 不用文字模板覆盖图片中已经明确存在的设定
模式 D|换装机制改造
当用户已有脚本,只想更换变装方式:
- 保留人物、服装、镜头、时长、布局
- 只替换换装触发与相应动作
- 先读
references/transition-library.md - 用户要多个方案时提供 3–6 个
参数锁定规则
用户明确给出的参数都是“锁定参数”,不得擅自替换、弱化或删除。
角色锚点
- 角色名称 / 基础身份
- 明确成年年龄或视觉年龄
- 国籍 / 族裔外观
- 脸型
- 五官与神情
- 肤色
- 妆容
- 眼睛
- 发型 / 发色
- 头饰 / 耳饰
- 整体气质
国籍与族裔外观
- 有参考图时,严格遵循参考图中可见的族裔外观,不使用默认值覆盖参考人物
- 用户明确指定国籍或族裔外观时,严格使用用户设定
- 没有参考图且用户未指定时,默认生成原创中国成年女性,以自然、真实的东亚面部特征呈现
- 使用默认值时,必须在参数锁定结果、图片提示词和视频提示词中显式写明“中国成年女性”,不得只依赖中文语境
- 除非用户明确要求,不得在无参考图场景中自动生成欧美面孔
- 不使用服饰、妆容或文化符号代替族裔外观,不生成刻板化、夸张化面部特征
造型
- 中央初始主造型
- 造型 1
- 造型 2
- 造型 3
- 造型 4
图片
- 画幅
- 拼贴布局
- 背景
- 光线
- 主色系
- 小人物描边
视频
- 时长 / 比例
- 机位与运镜
- 换装机制
- 动作基调
- 卡点时间
- 声音
- 结尾动作
缺失参数处理
不要要求用户一次填完全部参数。
可自动补全
未明确时可使用,并在结果中标记 系统补全:
- 默认人物:无参考图且未指定国籍 / 族裔外观时,使用原创中国成年女性,视觉年龄 22–28 岁,自然东亚面部特征
- 图片比例:9:16
- 视频比例:9:16
- 视频时长:8 秒
- 背景:浅灰白无缝影棚
- 光线:柔和漫射棚拍光
- 小人物描边:白色手绘贴纸虚线
- 视频默认固定机位
- 默认无文字、品牌、Logo、水印
- 默认基础点击 / 飞入 / 卡点音效
需要询问的情况
仅在高影响信息完全缺失且无法合理补全时问一个简短问题,例如:
- 没有参考图,也没有任何角色设定
- 要求多套服装但既没给服装,也没要求系统推荐
- 用户要求的镜头与换装方式互相冲突且无法兼容
不要为了补齐参数表而逐项追问。
默认五人拼贴版式
除非用户明确指定其它版式:
- 中央偏右:大型主体人物,约占画面宽度 60%–65%
- 左上:小人物
- 右上:小人物,默认腰部以上紧凑构图
- 左侧中部:小人物
- 左下:小人物
- 右下:留白
硬规则:
- 默认正好 5 个人物
- 5 人必须是同一角色
- 中央人物最大
- 四个小人物明显更小
- 小人物是沿真实身体轮廓裁切的完整人物抠像
- 四个小人物各自有独立白色虚线描边
- 中央人物不加虚线
- 禁止第六个人物
- 禁止用矩形缩略图替代人物抠像
用户明确要求 3–6 套造型时可改布局,但必须先在参数结果中说明新的布局逻辑。
首帧图片生成流程
按此顺序写完整版图片提示词:
- 画幅 + 超写实商业摄影任务
- 统一人物身份与外貌锚点
- 人物数量与拼贴布局
- 中央人物构图、姿态、主造型
- 四个小人物位置、构图、姿态、各自造型
- 白色虚线贴纸效果
- 背景、光线、镜头、皮肤、发丝、服装面料
- 主色系与画面气质
- 硬性限制
- 负面提示词
为视频兼容而优化
- 小人物不要采用极端扭曲姿势
- 头、肩、腰、手臂结构清晰
- 小人物与中央人物的身体拓扑尽量兼容,便于重合换装
- 袖摆、裙摆、披帛尽量完整,不要大幅裁切
- 五个版本的脸、发型、发色、头饰、耳饰统一
- 中央初始姿态要给后续动作留空间
- 背景保持简洁
换装机制选择
若用户指定机制,严格使用。
若未指定:
- 拼贴贴纸 + 互动选择:默认“完整人物飞入重合”(M1)
- 汉服大袖 / 披帛:优先“长袖/袖摆遮镜”(M2),其次“团扇/折扇遮挡”(M5)
- 古风贵女:优先“团扇/折扇遮挡”(M5)
- 强拼贴设计:优先“贴纸翻页/人物剪影翻转”(M8)
- 强节奏现代穿搭:优先“步伐/跺脚/手势卡点”(M10)
- 需要分身概念或衣橱人格表达:可用“分身归位融合”(M9)
- 东方幻想 / 神女:可用披帛、花瓣、云纹、水墨
- 高级清冷时尚:可用旋身、镜面
需要详细机制或备选方案时读 references/transition-library.md。
默认机制:完整人物飞入重合
- 指针点击目标小人物
- 复制出一个相同的完整人物抠像,作为飞入副本
- 原位置的目标小人物立即移除,不再保留,原位置留空
- 飞入副本沿斜线飞向中央并迅速放大
- 白色虚线始终贴合飞入副本的完整人物轮廓
- 飞入副本与中央人物的头、肩、腰、动作姿态重合
- 重合瞬间中央人物切换对应服装,飞入副本与虚线同时消失
- 换装后中央人物继续原动作
必须明确:
- 飞入的是复制出的完整人物副本,不是单独衣服
- 不是矩形卡片
- 原位置的目标小人物不保留,飞入开始时立即消失并留空
- 重合后中央只保留一个人物,不产生双影
视频时间轴生成流程
默认时长
默认 8 秒,5 套造型 = 初始造型 + 4 次换装。
默认换装完成点:
- 第 1 次:约 1.25 秒
- 第 2 次:约 2.95 秒
- 第 3 次:约 4.40 秒
- 第 4 次:约 6.55 秒
若总时长变化且用户未给卡点:
- 按以上时间点相对 8 秒等比例缩放
- 最后一段必须保留最终造型展示时间
若用户给了卡点:
- 严格使用
- 不擅自平均化
每段时间轴必须包含
- 时间范围
- 当前造型
- 人物动作
- 眼神 / 表情
- 换装触发
- 换装运动方向
- 换装完成时刻
- 换装后动作如何延续
- 发丝 / 袖摆 / 裙摆 / 流苏物理
- 必要音效
动作连续性
每次换装前后必须维持:
- 重心连续
- 旋转方向连续
- 手臂轨迹连续
- 头部朝向连续
- 眼神变化有因果
- 不因换衣重置姿势
使用“人物飞入重合”时:
- 飞入人物必须在头、肩、腰、姿势相合后再完成服装替换
衣料物理
汉服、长裙、长袖、披帛、流苏必须:
- 有自然重力
- 转身时有轻微惯性延迟
- 停止后逐渐回落
- 换装瞬间不中断物理连续性
- 不僵硬漂浮
- 不穿模
- 不粘连身体
镜头规则
默认固定高机位
适合拼贴式换装:
- 摄影机位于人物前上方
- 向下约 30–35°
- 近距离高机位俯拍
- 人物自然抬眼
- 头部和上半身更靠近镜头
- 裙摆向画面下方展开
- 全程固定
- 不推拉、不摇镜、不旋转、不变焦
若用户明确要求其它镜头,可用正面固定、轻微低机位、缓慢推近、轻微横移或半环绕。
短时长中不要同时叠加复杂运镜与复杂换装机制。
声音规则
默认无背景音乐,除非用户要求。
按机制加入:
- 鼠标点击声
- 飞入 / 滑动短促移动声
- 换装完成卡点声
- 轻微衣料摩擦声
- 古风可加入极轻丝带、扇面、花瓣掠过声
声音只服务换装节点。
强制一致性约束
完整输出中必须明确:
- 同一张脸
- 同一成年年龄感
- 同一国籍 / 族裔外观
- 同一肤色
- 同一发型 / 发色
- 同一头饰 / 耳饰
- 同一身材比例
- 只改变穿搭,不重做人物
- 换装前后动作连续
- 已使用的小人物贴图原位置不保留
- 不出现第六人物
- 不出现矩形缩略图
- 不出现双重中央人物 / 残影
- 不服装叠穿
- 不错误肢体 / 多余手指 / 身体融合
- 不头部裁切
- 不背景突变
- 不无故镜头移动
输出协议
默认输出以下内容。
1)参数锁定结果
只列本次真正使用的参数,不机械输出空字段。
格式:
## 参数锁定结果
- 角色:
- 成年年龄感:
- 国籍 / 族裔外观:
- 外貌锚点:
- 发型 / 头饰 / 耳饰:
- 初始主造型:
- 造型1:
- 造型2:
- 造型3:
- 造型4:
- 拼贴布局:
- 图片比例:
- 视频比例:
- 视频时长:
- 镜头:
- 动作基调:
- 换装机制:
- 换装卡点:
- 声音:
- 系统补全:
Signals
- GitHub stars
- 817
- Forks
- 128
- Last commit
- Sep 2026
Advanced
- Catalog kind
- skill
- Gateway key
female-outfit-director- Source
- github.com/liyue-aigc/female-outfit-director